不過好在上市第二天,股價迎來了微弱反彈,不過也始終在20元上下徘徊。
倒也讓投資者們好受了不少,至少沒虧錢!
當然,這些和周文關係不大,他仍舊在準備釋出會的事情。
但是7月12日,來自星火AI實驗室的一則訊息,讓他徹底坐不住了——羲和V2大模型完成了開發!
這是一款高達3500億引數的超大規模通用AI大模型。
相較於此前百億引數的羲和V1,它完成了跨越式的質變迭代,完全是兩個維度的產物。
聽完彙報,周文整個人都麻了!
上個月,openAI剛釋出了GPT-1,它僅1.17億引數,512詞元(Token)上下文視窗,僅能進行基礎文字生成,幾乎不存在邏輯思考與推理能力。
而這,己經是世界上最先進的AI大模型了。
但是在3月份,星火AI實驗室就己經推出了百億引數的羲和V1。
遠遠甩開全球同行!
如今僅隔4個月,團隊就完成了羲和V1的質變,達到了千億引數大模型!
體量是GPT-1的三百多倍!
而這還不是最主要的,羲和V2採用的是自研的SSM架構,天生優於Transformer架構。
在實際效能上,完全不是一個時代的東西!
“……羲和V2模型訓練總詞元量為1.8萬億,支援128K超大上下文視窗,約合9.6萬個漢字。”
“依託SSM架構的長序列天賦,模型可以完整通讀、邏輯校對、跨段落關聯十萬字級長文件。”
星火AI實驗室負責人周震驕傲的向周文介紹。
當初的量化模型完成後,AI團隊便被一分為二。
方旭帶著團隊繼續最佳化量化交易模型,周震則帶著團隊全力攻堅超大引數的羲和系列通用大模型。
“推理效能方面,模型文字生成速度可達65-80詞元每秒,是行業主流Transformer模型的1.8倍,通用問答準確率92%、基礎邏輯推理85%、專業場景78%……”
周震興致勃勃的介紹。
待其介紹結束後,周文首接問道:“它到底能做什麼?”
周震聞言更驕傲了:“文字能力上,支援28種主流語言高精度互譯,遠超行業基礎翻譯水平,可獨立完成長文件結構化梳理、專業標書、方案、文案定製創作。”
“推理能力上,覆蓋中小學全學段、大學基礎數理統計的分步解題,支援多步驟因果推演、職場決策分析,能夠滿足絕大多數日常、商用邏輯場景。”
“程式碼能力上,主打輕量化實用開發,支援Python、Java、SQL等主流語言的編寫、除錯、糾錯、最佳化,可完成自動化指令碼、資料分析、基礎小程式開發、資料庫運維等常規需求。”
“此外,還具備圖文識別、內容解讀、圖文校對等功能。”
(不負眾望,三章搞定!)








