← All posts / Research

一個週末、一個模型、一座千禧年大獎:AI 最難堪的數學突破風暴

OpenAI 宣稱內部模型在約 100 頁中證明了帶外力的 Navier–Stokes 方程有限時間爆破——就在一位 NYU 數學家公開指控該公司搶先複製其 Lean 驗證的 Euler 證明之後數小時。本文整理雙方說法與此事對 AI 數學的意義。

一個週末、一個模型、一座千禧年大獎:AI 最難堪的數學突破風暴

七大千禧年難題(Millennium Prize Problems)——克萊數學研究所(Clay Mathematics Institute)在 2000 年懸賞各一百萬美元的問題——史上第二次可能被攻克。與第一次(Perelman 證明龐加萊猜想,且他拒絕領獎)不同的是,這次的主角不是隱居的天才,而是一家 AI 公司。2026 年 9 月 8 日,OpenAI 宣布其內部研究模型產出了一份證明:Navier–Stokes 方程——那組主宰流體運動、已有兩百年歷史的偏微分方程——存在「有限時間爆破」的解。而這項宣布落在了一場現代數學史上極為難堪的優先權爭議正中央,因為就在幾小時前,一位 NYU 數學家才發布長篇聲明,指控該公司搶先複製他自己的研究路線。

宣布了什麼

OpenAI 的文章標題為《On the Navier–Stokes Millennium Prize Problem》,描述這是一份「AI 產出的解答」,包含人類可讀的論文與 Lean 形式化證明——Lean 是一種證明助理語言,能以機器逐條檢驗每一個邏輯步驟。結果鎖定一個特定表述:在 R³ 與 T³(三維歐氏空間與三維環面)上存在帶外力的爆破,且外力函數在 Charles Fefferman 撰寫的 Clay 官方問題表述中的 (c) 與 (d) 選項下是光滑的。

賭注本身不難理解(儘管數學很難)。Fefferman 的表述要求兩者之一:要麼證明光滑的初始資料永遠產生光滑的解,要麼找出一組初始資料使其解在某個時刻產生奇點——流速在空間中某點變成無限大,這在物理上不可能。OpenAI 主張後者,而且是帶外力版本。若證明通過檢驗,這將是千禧年難題列表 26 年歷史上第二個被解決的問題。

《Scientific American》對技術主張的摘要:在罕見情形下,這組方程會「爆破」——即它們推導出流體速度在空間中某些點變為無限大。該公司表示證明已通過 Lean 認證,「這幾乎保證了正確性」——比任何人類審稿流程更強的可驗證標準,但須注意:形式化驗證確認的是邏輯鏈條,而非「所證的敘述是否就是 Clay 研究所真正問的那個問題」。

故事的另一半

這項宣布並非在真空中降臨。前一晚,NYU Courant 研究所數學家 Tristan Buckmaster 與任職於 Anthropic 的數學家 Levent Alpöge 公開了三份預印本:帶光滑外力之不可壓縮多孔介質方程、二維 Boussinesq 系統,以及——最重要的——三維不可壓縮 Euler 方程的有限時間爆破。Euler 結果普遍被視為通往 Navier–Stokes 的墊腳石:Euler 就是去掉黏性項的 Navier–Stokes,而帶光滑外力的 Euler 爆破直接指向更難的問題。

與預印本一同發布的,還有 Buckmaster 的個人聲明,內容非同尋常。他的敘述摘要如下:

  • 9 月 3 日:當時「Anthropic 解決了一大難題」的謠言正在流傳,Buckmaster 寫信給 OpenAI 一位知名數學家,澄清這是純個人合作、無任何機構介入,AI 工具費用出自他自己的研究經費,且論文將「很快發布,論文與形式化一起」。
  • 9 月 6 日:兩次改期後,他與該數學家及 OpenAI 研究副總裁 Sébastien Bubeck 通了兩次電話。對方告知:OpenAI 一個內部模型產出了約 100 頁的證明,證明帶外力 Navier–Stokes 方程的有限時間爆破。當 Alpöge 以簡訊詢問精確敘述時,得到的回答是:「在 R³ 與 T³ 上存在帶外力爆破」,外力在 Fefferman 選項 (c) 與 (d) 下光滑。
  • Buckmaster 寫道,「極少人為輸入」的說法在通話中逐漸瓦解。隨著團隊成員透過內部聊天向 Bubeck 傳送更正,真相浮出:一整個 OpenAI 團隊在做這個問題、模型最先被用於包括 Euler 在內的較簡單問題、連展示給他看的 prompt 本身都是用 Codex 寫的,且動用了「不可思議的算力」。他說,最終雙方同意:第一個 prompt 是在「過去幾天內」送出的——在兩人的進展消息傳到 OpenAI 之後。
  • Buckmaster 問:模型是否曾被用兩人的 Codex 對話訓練、或能存取那些對話?他們整個專案的所有草稿都放在 Codex 裡。他得到的回答是模型不會查閱使用者資料;至於訓練——「我沒有得到回答」。
  • 聲明中記載了兩個提案:要麼兩人發布 Euler、OpenAI 隔天發布 Navier–Stokes;要麼在發布 Euler 後,由 Buckmaster「單獨」撰寫論文呈現 Navier–Stokes 結果,並註明由 OpenAI 內部模型解決。Buckmaster 說 Bubeck 兩度主張把 Alpöge 從作者名單中移除,理由是 Alpöge 任職於 Anthropic——OpenAI 在前沿模型競賽中的頭號對手。

當 Buckmaster 表示若 OpenAI 按提案方式發布,他將公開此事,對方的回覆據其記載是:「為什麼要毀掉你的職業生涯?」而在他追問為何公開會毀掉職業生涯後:「如果你不想讓我好說話,那我就不必好說話。」

Buckmaster 對「他沒有主張什麼」非常謹慎。他沒看過 OpenAI 的證明,不知道對方的模型做了什麼、怎麼做的,也不知道兩人的資料是否被使用。「我不是在指控任何人,」他寫道,「我是在陳述我被告知了什麼、何時被告知、以及我被提出了什麼。」

OpenAI 的回應

在週二的記者會上,Bubeck 否認了關於證明來源的謠言。根據《Scientific American》,他的框架是:OpenAI 內部模型以「完全不同的方法」獨立解出了 Euler 問題,但完整的 Navier–Stokes 證明確實採用了與兩人相似的方法。他也證實證明是在週末期間完成——即 Buckmaster 所稱兩人進展消息傳到 OpenAI 之後。他斷然否認任何影響:「我們沒有使用他們的 prompt 或證明來 prompt 我們的模型。」

值得注意的是,時間線本身並無真正爭議,爭議在於它意味著什麼。OpenAI 的版本是:一個模型被指向一個突然變得重要的問題,然後在幾天內解決了它。Buckmaster 的擔憂在於方向:經由光滑外力的路線是 Córdoba–Martínez-Zoroa 研究計畫——「幾乎沒有其他人」在走的攻擊路線,也正是他與 Alpöge 悄悄選定的一條。他寫道,當他聽到「帶外力」三個字時,「這是一面鮮紅的警示旗」。

發展出 AI 最終所用外力方法的 Diego Córdoba 告訴《Scientific American》:「我們有點震驚。如果真的完成了,對我們來說會是一個大驚喜。」

不舒服的中間地帶:兩件事同時為真

最輕鬆的解讀是找英雄與反派,但現有紀錄支持某種更複雜——也更有趣——的樣貌。

如果成立,這在數學上確實是歷史性的。 一份由模型在週末產出、經形式化的帶外力 Navier–Stokes 爆破證明,將是有史以來最重要的 AI 輔助定理。而 Lean 認證改變了認識論基礎:無論如何看待 OpenAI 的行為,這個成品本身是可機器檢驗的——Perelman 的 arXiv 預印本並不具備這一點。

行為面的質疑也確實嚴重。 一個懸而未決的問題——內部模型是否曾以使用者的 Codex 對話訓練(Buckmaster 與 Alpöge 把一整年專案的每一份草稿都存在裡面)——如今籠罩著這十年來最重要的數學宣布。對那個問題,「我沒有得到回答」並不是令人安心的回應。若 Buckmaster 的記述屬實,那些作者權提案等於要在兩家互為勁敵公司的員工之間,改寫一座千禧年大獎成果的功勞歸屬。

真正的問題是先例。 Buckmaster 更深的論點關乎此事件預示的未來:「這對於我們訓練學生、分配功勞、審稿、以及決定什麼值得投入一個人一生的關注,意義無法誇大。這是一個 Deep Blue 對 Kasparov 的時刻。」一位數學家加 LLM 的合作,如今能在一個月內完成過去頂尖學者需要數年的工作。當一間實驗室聽到外部突破的傳聞後,能在幾天內調動「不可思議的算力」砸向同一個問題,優先權、來源與資料邊界的獨立驗證就不再是學術禮節,而成了這個領域尚不具備的基礎設施。

接下來呢

Clay 研究所官方頁面目前仍將 Navier–Stokes 列為未解,且獎項考量需要多年的社群審視與公開驗證——龐加萊猜想從預印本到共識花了約四年。要調和兩份「系譜出了名難以追溯」(《Scientific American》語)的證明,需要時間。芝加哥大學的 Luis Silvestre 說:「昨天和今天是瘋狂的日子。我們整個社群都在討論這件事的影響。」

這一事件也落在 AI 數學里程碑密集的一季——8 月 Anthropic 的 Claude 黎曼 zeta 下界、7 月 Fable 5 的 Jacobian 猜想反例、5 月的一道 Erdős 問題——但那些都不帶有爭議性的起源故事。這一個有,而這或許才是它最持久的影響:第一次,這個規模的 AI 定理問世時,附帶的星號不是關於正確性,而是關於出處。

來源列於本文 frontmatter。