2039年12月,北京,西山。她花了整整三個月,把Transforr架構從自然語言處理領域搬到了戰場決策系統裡。王浩一開始覺得她瘋了,因為從來沒人這麼幹過。林小鏡說“沒人幹過,我來幹”。她把論文打印出來放在桌上,不是一篇,是二十篇。每一篇都用紅筆劃了重點,旁邊寫著批註。她的字很小,但很清楚,一筆一劃,從不連筆。王浩看了那疊論文,又看了她一眼,什麼都沒說。他知道,林小琴不是那種隨便翻翻就下結論的人,她看過的每一頁都記得住,推導過的每一步都不會忘。她讓他做的時候,基本上已經是對的了。
她提出的架構和原來的卷積神經網路完全不同。卷積神經網路像過濾器,一層一層地篩選特徵,邊緣、形狀、物體,逐層抽象。但戰場上的情況不是靜態的,敵人會動,戰術會變,局勢會演化。卷積神經網路處理不了時間序列,它沒有記憶。Transforr不一樣,它是基於注意力機制的,可以關注到戰場上的每一個關鍵點,還能記住過去的資訊。敵機從哪個方向來,之前出現過什麼動作,系統都可以結合這些判斷下一步怎麼反應。不是條件反射,是真的在思考。不是規則,是湧現出來的策略。有些連設計者自己都沒想到。
訓練資料是軍方提供的,過去十年的演習記錄和真實作戰資料。幾百個TB,裝了滿滿一硬碟櫃。林小鏡花了三週時間清洗資料,把噪聲濾波,把異常值剔除,把格式統一。她把資料切成幾百萬個片段,每個片段幾秒鐘。輸入是雷達訊號、紅外影像、電子對抗引數,輸出是決策指令。開火、規避、追蹤、釋放干擾,每一個決策都有時間戳。她把這些資料送進模型,讓它自己學。不是“教”它是規則,是“喂”它資料,讓它自己找規律。規律不是人定的,是資料里長出來的,可能對,也可能錯。錯了就改,對了就保留。她從來不假設自己是對的,她只相信資料驗證過的結論。
第一次訓練跑了整整一週。七臺伺服器同時執行,GPU滿載運轉,風扇的聲音像飛機起飛。林小鏡每天去看日誌,看準確率,看損失函式。第一輪過擬合了,準確率很高,但泛化能力很差。換個場景就不行了。她一看就知道,資料量還是不夠。陳處長又調來了過去二十年的演習記錄,加上北約的公開資料集和模擬模擬生成的合成數據。資料量翻了三倍。第二次訓練跑了十天,準確率從百分之七十五升到百分之九十一,泛化能力也好了很多。在模擬測試中,系統面對從未見過的場景,正確決策率達到百分之八十五。王浩看著結果說“可以了”。林小鏡說“還不夠”。她加了對抗訓練,自己生成攻擊樣本,讓系統自己打自己,逼它找出自己的弱點。弱點找到,補上。再找,再補。
第三輪訓練,準確率上了百分之九十五,泛化能力接近百分之九十。陳處長來看演示,螢幕上模擬了一場空戰。紅方是AI控制的戰鬥機,藍方是傳統的規則系統。紅方規避、佯攻、包抄、鎖定、開火,整個過程像經驗豐富的老飛行員,甚至更果斷。藍方被打得毫無還手之力。陳處長沉默了很久,看著螢幕上定格的畫面——紅方鎖定藍方的那一格,問了林小鏡一句話:“這個系統,能不能裝在無人機上?”林小鏡說“能”。陳處長又想了很久,才說“我回去彙報”。他走了,腳步聲在走廊裡漸漸消失。林小鏡站在螢幕前,看著紅方鎖定藍方的那個畫面。她沒覺得驕傲,只是覺得這條路走對了。走對了就繼續走,走錯了就拐彎。她不怕拐彎,只怕停在原地。
晚上,王浩收拾東西準備回招待所。他站在門口,回頭看她還坐在電腦前。“你還不走?”林小鏡頭也沒抬,說“我再看看資料”。王浩看了她一會兒。她的白頭髮在螢幕的光下反著光,銀白色的,很亮。眼睛裡映著程式碼和數字,紅棕色的瞳孔像一塊琥珀。她瘦了,但沒瘦多少,本來就不胖。王浩想說點什麼,但沒說出來,轉身走了。走廊裡響起他的腳步聲,一下一下的,越來越輕,然後消失。林小鏡沒聽到關門聲,她在看資料,有一條曲線走勢不太對,她要找出原因。不是急,是不能放。問題不解決,睡覺都睡不安穩。
她找到了。資料增量的步長設錯了,大了零點零一。改過來,重新跑。等結果的時候,她靠在椅背上,閉上眼睛。她想起了劉遠,想起了他說過的一句話:“你會走得很遠。”她現在算是走得遠了吧,但她覺得還不夠遠。她想走到問題盡頭。問題有盡頭嗎,她不知道。不知道就繼續走,走一步算一步。她睜開眼睛,結果出來了,曲線平穩了。沒有波動,沒有異常。她關掉電腦,站起來,走向門口。辦公室不大,她走了五步就到了。她關燈,鎖門。走廊裡很安靜,只有她的腳步聲,一聲一聲,在空蕩的空間裡迴響。電梯門開了,她走進去,數字從5跳到1,叮的一聲,門開了。她走出大樓,山風很冷,吹在臉上像針扎。她把外套拉鍊拉到最上面,縮了縮脖子,快步走向停車場。車在等她,她坐進去,關上車門,擋住了外面的風。








