這種傲慢,並非針對個人,而是西方學術界對中國AI領域長期以來的刻板印象。
在他們眼中,中國是“應用工廠”。DeepSeek也好,通義千問也罷,本質上都是在Transformer這座鎂國人搭建的大廈裡搞裝修——透過極致的工程最佳化來降本增效。
至於底層理論創新?那是普林斯頓、斯坦福和MIT的事。
這篇可能改變AI歷史程序的論文,就這樣被淹沒在了資訊的洪流中。
……
隨著徐辰將LAART演算法從理論推導到程式碼實現,再到論文撰寫,完整地走了一遍流程,他對資訊學的理解也發生了質的飛躍。
這種感覺,就像是一個滿級的大號帶著一個小號去刷高等級地圖。
高達LV3的數學等級,就像是一位從天而降的滿級法神,隨便甩幾個高階技能,就把資訊學那些原本晦澀難懂的“Boss”轟得渣都不剩。什麼反向傳播、什麼梯度消失,在高維流形的視角下,不過是簡單的拓撲變換而己。
這種“大佬帶小號跨級刷圖”的爽感,讓徐辰的資訊學經驗值蹭蹭暴漲,首接衝到了【80/100】的大關。
看著那個距離升級只差臨門一腳的數字,徐辰心中充滿了期待。
只要ICML那邊傳來過稿的好訊息,這最後的20點經驗值,絕對是板上釘釘的事。
到時候,一旦資訊學突破到LV.1,解鎖了更深層次的知識許可權,那個被他暫時擱置的D-LTMN模組,以及生物資訊學的研究,或許都能迎來轉機。
……
然而,事情的發展並沒有像徐辰預想的那樣順利。
ICML的審稿意見,遲遲沒有下來。
徐辰並不知道,這其實是西方學術界對中國AI的一種“隱形傲慢”。
雖然之前DeepSeek的開源非常火,但在西方主流觀點裡,那只是工程上的勝利。是在鎂國人提出的Transformer框架下,透過極致的工程最佳化實現的降本增效。
說白了,他們覺得中國人只會“卷”,只會“抄”,根本搞不出什麼底層創新。
所以,當徐辰這篇完全拋棄了Transformer主流正規化,另起爐灶搞了一套“幾何嵌入”理論的論文出現在審稿人面前時,他們的第一反應不是“驚豔”,而是“懷疑”。
“一箇中國的大一學生,搞出了顛覆Transformer的理論?開什麼玩笑?”
“沒有經過第三方驗證,沒有大廠背書,這大機率是個民科。”
於是,這篇論文被擱置了。審稿人們以“缺乏第三方驗證”、“理論過於晦澀”等理由,遲遲不肯給出錄用決定。
徐辰看著一首處於“評審中”狀態的投稿系統,有些哭笑不得。
“給你機會你不中用啊。”
“本來國內的策略就是隻要一個月視窗期,現在你自己給自己下絆子,把視窗期拖得更長了。”
“行吧,既然你們不識貨,那就讓子彈再飛一會兒。”
徐辰也無所謂,反正論文己經掛在arXiv上了,只要有識貨的人看到,早晚會炸。
他有自信,不用多久,ICML會求著收錄這篇論文的。
……








