跳至主要內容
Buzzdope Buzzdope
社群

一百道難題先解開,OpenAI 才回頭敲了數學界的門

Buzzdope 編輯室
一百道難題先解開,OpenAI 才回頭敲了數學界的門

8 月 28 日,一個連名字都沒公開的模型在 OpenAI 內部開始訓練。9 月 22 日公告刊出時,OpenAI 給它配上的成績單是這樣的:解開了數學界多個領域一百多道長期未解的開放問題,名單裡包含納維-斯託克斯這道千禧年大獎難題,公告還特別註明它「此前引發爭議」。從開訓到公告,前後 24 天。

同一天,OpenAI 宣布成立「數學與 AI 顧問組」,設在普林斯頓高等研究院,由九位數學家組成。以上均為官方公告內容,經 IT之家 9 月 22 日公開報導。一個跑得極快的模型,和一扇剛裝好的門,被放進了同一份公告。

二十四天,一百多道題

關於模型本身,公告透露的資訊有限:8 月 28 日開始訓練、沒有公布名稱、解題範圍橫跨多個數學領域。OpenAI 說,它在數學上的進展速度令公司內部的數學家感到驚訝,甚至引發了內部討論:該怎麼以最好的方式告訴學界。

這段話的微妙之處在於措辭。一家習慣發表會節奏的公司,這回花篇幅談「如何告知」,等於承認做出結果與說出結果是兩件事。OpenAI 的解釋是,數學屬於基礎科學,新的數學發現可能有廣泛應用,相關能力的開發與部署需要採取更穩重的方式;公司正在研究如何更廣泛地部署數學相關的 AI 能力(官方公告)。

統計圖卡顯示 OpenAI 未命名模型在 24 天內宣稱解開超過一百道長期未解的數學開放問題
自 8 月 28 日開訓起算 24 天

圍觀羣眾的反應則是另一套劇本。這兩年 AI 圈的豪言不少,先對帳再鼓掌已經成了習慣,先前馬斯克把明年 GDP 翻到 4% 的發文就演過同款戲碼。這一回的帳更難對:證明沒有隨公告附上,一百多道題暫時只存在於公告的句子裡。

信寫在門開之前

顧問組的成立有明確的前情。此前,陶哲軒、鄧煜、彼得·舒爾茨等數學家聯名發表公開信,對「把解決數學開放問題當成新型 AI 系統基準」可能產生的負面影響表達擔憂(據 IT之家報導)。OpenAI 在 9 月 22 日的公告裡正面接下這個議題:這些意見顯示,AI 公司有必要與數學界展開更充分的交流。

引言圖卡引述 OpenAI 公告中對數學能力開發與部署須更穩重處理的立場說明

公告沒有附上公開信的原文,數學圈面對這類消息的老問題也沒有消失:證明在哪裡,由誰驗證。OpenAI 選擇的回應方式,是把一個有權公開說話的小組放進制度裡。

九個名字,三座菲爾茲獎

選址在普林斯頓高等研究院。這個院子在科普讀物裡的出場率一向不低:愛因斯坦在這裡度過晚年,馮·諾伊曼也在這裡寫下電腦世代的開場篇章。把「數學與 AI」的對話機制放進這個院區,地點本身就是訊息。

首批九位成員(官方公告):

  • François Charles(巴黎高等師範學院)
  • Camillo De Lellis(普林斯頓高等研究院、格蘭薩索科學研究院)
  • Timothy Gowers(法蘭西公學院、劍橋大學)
  • Martin Hairer(洛桑聯邦理工學院、倫敦帝國學院)
  • Nikhil Srivastava(加州大學柏克萊分校、西蒙斯研究所)
  • Ulrike Tillmann(牛津大學)
  • Ravi Vakil(史丹佛大學)
  • Edward Witten(普林斯頓高等研究院)
  • Melanie Matchett Wood(哈佛大學)

三位菲爾茲獎得主在列:1990 年的 Edward Witten、1998 年的 Timothy Gowers、2014 年的 Martin Hairer。其中 Witten 本身就是高等研究院教授,等於在自家院子裡開會。另一個細節更有意思:九人之中,只有 Camillo De Lellis 一人在那封聯名公開信上簽過名。

清單圖卡整理數學與AI顧問組的四個數字:九位成員、三位菲爾茲獎得主、一位公開信簽署者、成員不支領報酬

可以評論結果,不能決定速度

顧問組的權限寫得相當具體(官方公告):

  • 獨立於 OpenAI 運作
  • 可以提出 OpenAI 未徵詢的建議
  • 可以公開評論 OpenAI 對數學的影響
  • 可以自行決定調整成員組成
  • 成員不從 OpenAI 領取報酬

但書同樣具體:顧問組不負責就 OpenAI 內部數學研究的推進節奏提供建議。

職責上,小組將就新興成果的評審與傳播提供建議、協助評估成果的重要性、就數學研究的學術標準給意見,也會就 OpenAI 的工具如何支持數學研究與學習提供建議。把權限和但書合起來讀,界線很清楚:這個小組對「怎麼發表」有發言權,對「跑多快」沒有。這條線畫在哪裡,數學界接下來會盯著看。

難題的圍觀簡史

千禧年大獎難題的光環是 2000 年掙來的。克雷數學研究所選出七道題,每題懸賞一百萬美元(克雷研究所公開資料)。二十多年過去,真正被解開的只有龐加萊猜想:佩雷爾曼把證明陸續貼上 arXiv,之後拒絕了菲爾茲獎,也拒絕了那一百萬美元,學界花了約四年才確認證明成立。

驗證的成本,數學史上有的是帳本。懷爾斯 1993 年宣布證出費馬大定理,審查中抓出漏洞,補了將近兩年才在 1995 年正式發表。望月新一 2012 年提出 ABC 猜想的證明,至今爭議未消,公開質疑者之一正是這次聯名信的簽署人舒爾茨。這些案例的共同點很樸素:一道大題被宣稱解開,只是上半場。

機器加入之後,上半場被大幅壓縮。2016 年 AlphaGo 的圍棋一戰是老座標,2024 年 DeepMind 的 AlphaProof 在國際數學奧林匹亞達到銀牌水準(DeepMind 官方公告),之後紀錄一路改寫,前陣子GPT-6-Astra 在洛谷刷出整排 AC 也是同一章的情節。至於 OpenAI 自己,先前已有報導:一萬個 AI 代理花 88 小時攻千禧年大獎難題時,陶哲軒既表態肯定、也公開表示擔憂;霍奇猜想即將被攻克的傳聞流傳過一輪,Claude 嘗試黎曼猜想的舊聞也被反覆翻出。這齣劇有前集,納維-斯託克斯只是最新一幕。

誰來批改這份答卷

公告留下的空白同樣清楚:一百多道題的證明何時公開、以什麼形式公開、由誰先審,都沒有交代。顧問組職責清單上的第一項,就新興成果的評審與傳播提供建議,像是為這一刻預留的座位。

過去的順序是先有難題,等一個答案,再用幾年驗收。現在答案成批到貨,最稀缺的東西換成了數學家的閱讀時間。九位不支薪的顧問可以幫 OpenAI 把話說好,但一百多份答卷終究要有人逐行看完。

最後留一個老問題:一份還沒有人驗完的證明,算不算已經解開?那封聯名信擔心的,也許正是這個問題被跳過的那一刻。