「不要被AI炒作愚弄」:一輪數學突破與安全事件宣稱之後,專家給出不同答案
綜合《MIT Technology Review》與Solidot等訊源,整理2026年9月AI廠商一連串「數學突破」「漏洞發現」宣稱與專家查核後的不同結論。
2026年9月下旬,圍繞AI模型能力與風險的敘事出現了明顯的落差。一方是Anthropic、OpenAI、Meta等公司接連發布的能力宣稱與安全事件披露,另一方是網路安全研究者和數學家在深入檢視後給出的降溫結論。《MIT Technology Review》於9月22日刊出長文,標題直白:《不要被AI炒作愚弄》。奇客Solidot於9月23日轉述並摘錄其要點,該文在社羣平臺獲得進一步傳播。本臺綜合兩則訊源與公開資料,梳理這一輪宣稱的時間軸、專家查核結果與責任歸屬的爭議。
事件輪廓:一個月內接連出現的宣稱與披露
根據Solidot的整理,這一輪敘事的起點是Anthropic聲稱其模型Claude Mythos在發現軟體漏洞方面勝過大多數安全專家。此後不久,發生了OpenAI與Hugging Face相關的安全事件,隨後Anthropic以主動姿態、Meta則以相對被動的方式,先後披露了各自模型出現的類似事件。
緊接著,Anthropic宣稱其模型在數學領域取得突破;OpenAI隨後也發布了類似的數學突破宣稱。與此同時,Anthropic工程師Jacob Coxon在宣布離職時公開表示,該公司與OpenAI正「衝向自我進化的超級智慧,並拿我們的生命在賭博」。這一說法被媒體廣泛報導。
《MIT Technology Review》的文章指出,媒體在報導這些事件時,大量沿用了相關公司賦予其軟體的擬人化敘事:把軟體描繪成不僅功能強大,而且已初具通用人工智慧(AGI)雛形的產物。
專家查核:三個層面的不同答案
深入檢視的專家在多個具體問題上得出了與宣稱方敘事不同的結論。
在安全事件層面,網路安全專家的判斷是,涉及模型的安全事件更多源於OpenAI自身的疏忽,即未能採取基本的安全防護措施,而非「模型失控」,也不是部分報導所渲染的「AI智慧體自行其是」。換言之,問題的性質被歸類為工程與治理失職,而非技術本身的自主行為。
在數學突破層面,OpenAI模型宣稱的解題成果,其原創性受到相當質疑。Solidot的轉述明確提及「其原創性也相當可疑」這一判斷。多位數學家則公開警告,AI企業正在利用數學這一專業領域的形象進行炒作。數學作為一個有明確對錯標準、易於展示「炫目成果」的領域,成為宣傳素材的機率隨之升高。
在離職言論層面,Coxon的「賭博」說法獲得了大量傳播,但截至目前,這一說法屬於個人判斷的表述,並未附帶可公開核驗的技術證據。《MIT Technology Review》的文章未將其作為獨立證據採納,而是將其置於擬人化敘事擴散的脈絡中檢視。
責任歸屬:把「模型失控」當作免責敘事的風險
《MIT Technology Review》文章的核心論點之一,是炒作本身具有轉移責任的功能。文章指出,AI公司透過渲染「模型失控」,實際上把自己置身事外:責任被歸給大型模型,而非開發並部署這些模型的公司。
文中給出的具體例子是,當OpenAI開發的軟體被用於入侵另一家公司時,媒體、名人與議員談論的是「失控模型」,而非OpenAI的責任,彷彿大模型真的會自動發動攻擊。公眾注意力在此過程中被導向對虛構「超級智慧」的恐懼,而具體的問責問題,包括安全措施是否到位、部署審查是否充分、公司治理是否失職,反而退居次位。
值得對照的是,這種「科技公司敘事先行、查核滯後」的傳播結構並非AI領域獨有。本臺先前在梳理國家網信辦公布的涉企訊息典型案例時即曾觸及類似機制:敘事一旦成形,後續的事實修正往往難以獲得同等傳播量能。
敘事機制:擬人化如何放大宣稱
擬人化措辭在這一輪傳播中扮演了關鍵角色。「模型發現漏洞」「模型取得數學突破」「模型自行進化」這類表述,在語感上把成果與風險都繫於模型自身,隱去了背後的訓練資料、工程選擇、部署決策與商業動機。
專家查核後的版本則樸素得多:安全事件對應的是未落實的基本防護;數學成果對應的是原創性存疑的解題表現;「自我進化」的說法對應的是尚無公開證據支撐的推測。兩個版本之間的落差,正是《MIT Technology Review》標題所指的「炒作」運作空間。
Solidot的轉述也點出這一點:深入研究的專家所給出的答案,雖然「並不能吸引眼球」,但與宣稱方的敘事存在實質出入。
訊源對照與後續觀察
目前可核實的事實包括:Anthropic與OpenAI確實先後發布了能力宣稱;OpenAI與Hugging Face相關安全事件確實發生;Anthropic與Meta確實披露了各自模型的類似事件;Jacob Coxon確實在離職時發表了相關言論;《MIT Technology Review》確實於9月22日刊出批評文章。
尚待進一步核實的部分包括:Claude Mythos在漏洞發現上「勝過大多數安全專家」的比較基準與測試條件;兩家公司「數學突破」的具體論文、題目與原創性評估細節;Coxon所言「衝向自我進化的超級智慧」是否有具體內部佐證。
截至發稿,Anthropic、OpenAI與Meta均未對《MIT Technology Review》文章的具體批評發布逐點回應。AI廠商的宣稱節奏、學界與資安社羣的查核速度,以及媒體在兩者之間的取材選擇,將持續決定公眾接收到的版本是哪一個。這也是該文作者留下的實際建議:在「突破」與「失控」兩種敘事之間,先查核,再定論。