如果只是提前錄製好的展示程式,不該出現算力佔用升高、回答質量波動和上下文遺忘等問題。
一名參加大會的硬核科普博主,在引力社群上傳了一張現場測試的對話截圖。
截圖裡,他沒有讓天問長篇大論,而是輸入了一個簡短卻暗藏邏輯陷阱的純文字問題。
“房間裡有五個人。甲在看書,乙在下棋,丙在睡覺,丁在寫字。請問戊在幹什麼?”
這是一個經典的隱性條件推理題。
傳統的搜尋引擎遇到這種問題,只會抓取這幾個動作的關鍵詞,給出一堆毫不相干的網頁連結。
但天問在停頓了西秒後,在螢幕上逐字給出了回覆。
“戊在和乙下棋。因為下棋通常需要兩個人進行,而甲、丙、丁都有明確的單人活動,所以戊是乙的對手。”
這名博主在截圖上方配了一段評價:
“能力邊界很明顯,它現在還無法處理極其複雜的長文字巢狀,但對於這種簡短的常識推理,它展現出了讓人後背發涼的思考能力。它不僅讀懂了字面意思,還補全了人類沒有寫出來的隱性條件。”
評論區沒有因為問題簡短而冷下來。
【終於看到正常的硬核評測了,前面那些全在寫情書。】
【這才是最恐怖的,它知道下棋需要兩個人,它具備了人類社會的常識!】
【現在就開始擔心人類智力被取代是不是太早了?】
【不早,先擔心自己的飯碗吧。】
然而,天問登上熱搜不到一個小時,質疑內容也開始集中出現。
數十個賬號同時釋出長文,標題幾乎一個風格。
《所謂大語言模型,不過是一場精心準備的科技魔術》
《十五億引數製造出來的資本神話》
《迴響天問疑似後臺真人回覆,現場測試全是託》
文章提出了幾項證據。
體驗區只開放十臺電腦,所有裝置必須連線雅安伺服器,外界無法獲得模型檔案。展示現場也沒有公開完整技術報告,更沒有第三方機構進行獨立驗證。
還有文章聲稱,所謂生成內容只是大型模板庫的組合,後臺透過關鍵詞匹配,再由人工進行快速修改。
一張模糊的後臺機房照片也被轉發出來。
照片裡坐著幾十名工作人員,標題寫著“天問人工回答團隊疑似曝光”。
水軍很快湧入熱門帖子。
【十臺機器,幾十個後臺員工,一人盯一臺都綽綽有餘。】
【提前準備幾百套腦筋急轉彎答案,現場換幾個關鍵詞,有什麼技術含量?】
】。慧智工人是又在現,充超是先,銷營做會很響迴【
】。吧試測方三第讓敢不?開公不麼什為案檔型模【
】。家學科能也服客覆回自那,考思就語謎個猜信封幾寫【
。臺平個各到延蔓快很吵爭
。錄記字文和片照場現的度角同不找翻始開者持支
。碼令指試測的響迴到收有沒己自示表,案檔攝拍始原和件證訪採的己自開公者記有還。輸時臨者驗由題問明證,程全隊排傳上人有
。來出了發片照稿草的問提場現將師教學大名一
。字數的盾矛相互放意故中其,例案易貿際國的寫編時臨道一是的試測他
。潤利定確出給絕拒並,突衝字數了現發問天
】?備準前提何如工人臺後。員人作工何任給有沒前輸,上紙在寫才分三十點兩午下題道這【
。進跟刻立者疑質
】。道知前提要需不本答回工人,臺後到傳時即能都容盤鍵和音語【
】。看看我給工人種這個幾找去你,析分整完出寫再,字百幾完讀秒十【
】?怪奇麼什有手高到招,多錢的給響迴【
】。生字逐是可上幕螢,字打得也手高【
。品產的出釋去過響迴到吵本資從又,本資到吵技從方雙
。論爭進拉部全被問天、閃星、樞天
。腳住得站項一有沒麼什為控指假造的前此問反,料資測實的站範示樞天出接首人有也,念概造製於善響迴說人有
。篇百三過超經己稿黑的上臺平,點十上晚了到
。面介文中了換案專源開外海是只問天,稱聲始開章文分部
。案答出給有沒終始卻號賬稿發,時哪在址地碼式程、誰是者作文論、案專個哪是問追友網當可
。溫升在還論爭
。錄記新條一了現出頁首 viXra 臺平學本印預的大最球全,候時這在就
。文論構架層底的新最了傳上式正室驗實天九下旗響迴
。文英的單簡句一有只題標文論
》deeN uoY llA sI noitnettA《








