《重生2015,從奶茶店開始逆襲》第339章 羲和V2(2)

作者:修羅大道·1個月前

不過好在上市第二天,股價迎來了微弱反彈,不過也始終在20元上下徘徊。

倒也讓投資者們好受了不少,至少沒虧錢!

當然,這些和周文關係不大,他仍舊在準備釋出會的事情。

但是7月12日,來自星火AI實驗室的一則訊息,讓他徹底坐不住了——羲和V2大模型完成了開發!

這是一款高達3500億引數的超大規模通用AI大模型。

相較於此前百億引數的羲和V1,它完成了跨越式的質變迭代,完全是兩個維度的產物。

聽完彙報,周文整個人都麻了!

上個月,openAI剛釋出了GPT-1,它僅1.17億引數,512詞元(Token)上下文視窗,僅能進行基礎文字生成,幾乎不存在邏輯思考與推理能力。

而這,己經是世界上最先進的AI大模型了。

但是在3月份,星火AI實驗室就己經推出了百億引數的羲和V1。

遠遠甩開全球同行!

如今僅隔4個月,團隊就完成了羲和V1的質變,達到了千億引數大模型!

體量是GPT-1的三百多倍!

而這還不是最主要的,羲和V2採用的是自研的SSM架構,天生優於Transformer架構。

在實際效能上,完全不是一個時代的東西!

“……羲和V2模型訓練總詞元量為1.8萬億,支援128K超大上下文視窗,約合9.6萬個漢字。”

“依託SSM架構的長序列天賦,模型可以完整通讀、邏輯校對、跨段落關聯十萬字級長文件。”

星火AI實驗室負責人周震驕傲的向周文介紹。

當初的量化模型完成後,AI團隊便被一分為二。

方旭帶著團隊繼續最佳化量化交易模型,周震則帶著團隊全力攻堅超大引數的羲和系列通用大模型。

“推理效能方面,模型文字生成速度可達65-80詞元每秒,是行業主流Transformer模型的1.8倍,通用問答準確率92%、基礎邏輯推理85%、專業場景78%……”

周震興致勃勃的介紹。

待其介紹結束後,周文首接問道:“它到底能做什麼?”

周震聞言更驕傲了:“文字能力上,支援28種主流語言高精度互譯,遠超行業基礎翻譯水平,可獨立完成長文件結構化梳理、專業標書、方案、文案定製創作。”

“推理能力上,覆蓋中小學全學段、大學基礎數理統計的分步解題,支援多步驟因果推演、職場決策分析,能夠滿足絕大多數日常、商用邏輯場景。”

“程式碼能力上,主打輕量化實用開發,支援Python、Java、SQL等主流語言的編寫、除錯、糾錯、最佳化,可完成自動化指令碼、資料分析、基礎小程式開發、資料庫運維等常規需求。”

“此外,還具備圖文識別、內容解讀、圖文校對等功能。”

(不負眾望,三章搞定!)

猜你喜歡

同題材或同分類的其他作品。