跳至主要內容
科技 分析

25 位菲爾茲獎得主連署「AI 錯位」聲明:最歡迎 AI 的那一位,也在名單上

25 位菲爾茲獎得主連署發布《AI 在數學領域的嚴重錯位》聲明,本文分析連署陣容發出的訊號、錯位可能落在哪些環節、四色定理的歷史對照,以及後續可驗證訊號。

Techroomage 編輯部 閱讀約 8 分鐘
25 位菲爾茲獎得主連署「AI 錯位」聲明:最歡迎 AI 的那一位,也在名單上

一份以《AI 在數學領域的嚴重錯位》為題的聯合聲明,集結了 25 位菲爾茲獎得主,連長年把 AI 工具用得最順手的陶哲軒也署名;至於知乎上「傳統數學是否崩潰」的追問,得先讀懂「錯位」兩個字。

最挺 AI 的那個人,也簽了名

在數學圈要找一位比陶哲軒更早擁抱 AI 工具的明星,並不容易。他在自己的部落格上逐代測試聊天機器人與程式輔助工具,形容它們像反應很快、卻時常自信出錯的初階研究夥伴;他把形式化證明語言 Lean 當成日常,2023 年底與合作者只花約三週,就把一個組合學猜想的證明完整寫進 Lean;他主持的協作專案動輒十幾位作者,把數學做成開源軟體圈的工作方式。

正是這樣一個人,如今把名字簽在一份標題帶著「嚴重錯位」字樣的聲明上。這個動作本身就是整份文件裡資訊量最大的一行:當數學界對 AI 最友善的意見領袖也署名警告,被批評的對象就很難是工具本身。

聲明由 25 位菲爾茲獎得主連署,名單從 2006 年獲獎的陶哲軒,到研究偏微分方程的年輕一端鄧煜,橫跨多個世代。菲爾茲獎每四年在國際數學家大會頒發,只授予未滿四十歲的數學家,長年被視為數學界的最高榮譽;這個羣體鮮少就單一技術議題集體發聲,因此聲明近日在知乎曝光後,討論迅速升溫,提問直接落在「是否意味著傳統數學研究模式的崩潰」。

25 位菲爾茲獎得主的連署聲明以「AI 在數學領域的嚴重錯位」為題,作為整份文件的核心診斷

「錯位」這個詞,比「威脅」選得準

從措辭看,連署者刻意挑了一個診斷型的詞。標題裡沒有「威脅」,沒有「取代」,也沒有末日修辭;「錯位」說的是位置放錯了。AI 的能力被宣傳成數學研究的答案,它實際擅長的環節,與數學研究真正稀缺的環節,剛好對不上。

數學研究稀缺的向來是這幾件事:提出對的問題、發明對的定義、為幾十頁論證的正確性背書。這些恰好是現階段 AI 最弱的部分;它強的是模式配對、套路解題與高速生成草稿。競賽題有清楚終點與標準答案,研究題連題目都要自己找,陶哲軒本人在公開發言裡多次區分過這兩種難度的量級。當 IMO 金牌宣稱被直接換算成研究能力,落差就成為聲明所說的錯位。

另一條錯位在誠信面。論文裡 AI 摻了幾成,審查者看不出來;稿件量上升,單篇可投注的查證時間下降;引用與功勞的歸屬開始滑動。數學以「證明」二字運作,本質上喫信用,最先被拉緊的就是審查制度。這兩年科技圈為「AGI 已經到來」的定義權吵了一輪,數學圈有精確對照:宣稱解開難題,與被同儑接受,中間隔著一整套驗證程序。

為什麼是現在

聲明出現的時點,落在 AI 能力宣稱密集跳級的三年裡。2020 年底,舒爾茨把自己最重要定理之一的證明放上線,邀請社羣用 Lean 逐步驗證,這場後來被稱為液態張量實驗的專案,讓形式化從邊緣嗜好變成認真選項。2024 年,DeepMind 的 AlphaProof 與 AlphaGeometry 在 IMO 拿下銀牌水準,值得留意的是 AlphaProof 的答案直接寫成 Lean 程式碼,強項是可在形式系統內檢查的推進。2025 年,至少兩家實驗室宣稱模型在 IMO 達到金牌等級。到今年,本站先前報導的OpenAI 以一萬個代理人宣稱解開納維-斯託克斯難題,把敘事推到頂點,也把功勞歸屬與研究資料流向的爭議一併推上檯面。

觸發點因此清楚:當宣稱從輔助寫程式升級到千禧年難題,而驗證程序遠遠跟不上,學界遲早要集體表態。鄧煜所處的偏微分方程社羣,正是流體方程類宣稱最密集的區域;世代光譜兩端同時署名,說明焦慮不分資歷。

時間軸清單列出 2020 年液態張量實驗、2023 年 PFR 形式化、2024 年 AlphaProof 銀牌、2025 年 IMO 金牌宣稱與 2026 年千禧年難題宣稱五個節點
能力宣稱的量級三年內連續跳升

四色定理照過來的鏡子

把時間軸拉長,現在的爭論幾乎是 1976 年的重播。Appel 與 Haken 用超過一千小時的電腦運算證明四色定理,成為第一個無法靠人手覆核的主要定理。當年的問題與今天同款:機器跑出來的結果,算不算數學家說的證明?

數學界後來的處理方式值得整個科學界參考。他們沒有拒絕電腦,也沒有放棄「證明必須可查驗」的標準,選擇投資驗證技術本身;2005 年,四色定理被完整放進證明助理重驗,爭議落地。計算代數系統進入日常研究,arXiv 在 1991 年改寫論文流通,每一次工具進場,更新的是驗證與出版的規範;問題、猜想、證明、同儕檢驗這條主幹,半世紀來沒有離場。把規範重整讀成模式崩潰,歷史紀錄不支持這個讀法。

段落標語寫著「工具進場,規範更新,核心延續」,總結四色定理的歷史經驗對當前 AI 爭議的啟示

誰的負擔變重,誰的產能放大

錯位的成本分配並不平均。審查者與期刊編輯最先感到變重:arXiv 近兩年投稿量跳增,官方多次公開討論生成式內容帶來的品質壓力;無償審查撐著的制度,吞吐量卻被要求加倍。研究生面對的則是訓練的岔路,草稿可以外包給模型之後,基本功的投資報酬變得模糊;但判斷模型輸出對錯的能力,恰恰建立在那些基本功上,這一點很少被說清楚。

被放大的是另一端。陶哲軒的形式化協作已經示範:具備品味與驗證能力的人,拿到的是產能倍增器;這兩樣還沒長成的人,拿到的是更難察覺的錯誤。工具放大既有的差距,它不負責縮小。

對圈外讀者,這份聲明送上一把過濾頭條的尺。往後再看到「AI 解開世紀難題」的宣告,先查兩件事:成果有沒有形式化或完整同儕審查的紀錄;發布單位與簽名者的利益位置。兩個答案湊齊,宣稱的成色大致就清楚了。

可以盯的幾個訊號

聲明的實際影響力,取決於制度有沒有接住它。可驗證的觀察點包括:arXiv 與主要期刊的 AI 使用披露政策是否收緊;形式化驗證是否從小眾技能變成研究所課綱的正式內容;大型實驗室是否做出實質回應,調整宣稱的尺度;國際數學家大會與各大獎項的議程,會不會把驗證規範排進正式討論。這些訊號任何一條落地,都比「崩潰與否」的口水戰更有資訊量。

回到知乎的問題:傳統數學研究模式會崩潰嗎?連署者用「錯位」兩個字給了他們的判斷。這份文件的性質比較接近診斷書,標出 AI 該放與不該放的位置:草稿、搜尋、形式化的粗活交給它,問題、定義與最終的驗證留給訓練有素的人,宣稱者為可驗證性負責。把它讀成傳統數學的訃告,恐怕連署者自己都不會同意。