AI Newsway

OpenAI一萬智慧體的納維-斯托克斯證明,帶著一個註腳落地

該實驗室稱一群智慧體找到了流體奇點,同時表示不會申領那100萬美元獎金。

|6分鐘閱讀0
Large-scale fractal motion in cloud formations, an everyday illustration of the turbulent flow the Navier-Stokes equations attempt to describe.
Large-scale fractal motion in cloud formations, an everyday illustration of the turbulent flow the Navier-Stokes equations attempt to describe.

9月8日上午,OpenAI的數學家宣佈,約一萬個自主智慧體在研究人員的引導下,運行於一個外界無法訪問的內部模型之上,在三維納維-斯托克斯方程中找到了一個奇點。可不到十二個小時,數學界爭論的焦點已經不是流體力學本身,而是功勞該歸誰。

核心要點

  • OpenAI稱,約一萬個智慧體工作了88小時、交換近500萬條訊息後給出爆破(blowup)證明,隨後另一個模型又用17小時將其在Lean中形式化。
  • 該公司不會申領100萬美元的克雷獎金,因為其構造依賴一個外力項,而官方的千禧年問題表述並不允許這一項。
  • 比OpenAI早12小時公佈相關結果的紐約大學學者特里斯坦·巴克馬斯特暗示,OpenAI可能看到並受益於他與Anthropic的萊文特·阿爾波格的工作;OpenAI的塞巴斯蒂安·布貝克對此予以否認。

智慧體究竟證明了什麼

寫於19世紀中葉的納維-斯托克斯方程,是把牛頓第二定律應用於流體。克雷數學研究所在2000年為之懸賞100萬美元的這道未解難題問的是:它的解是否始終保持規則,還是說某一團微小到幾乎消失的流體可以開始以無限快的速度運動。後者就是奇點,在這一領域裡通常簡稱為爆破。

OpenAI給出的答案是:爆破會發生。根據該公司的技術文章,團隊先把約100個智慧體指向描述無摩擦流體的尤拉方程,約50小時後得到了正則性的反證。隨後針對納維-斯托克斯把規模擴大到約一萬個智慧體。這些智慧體運行了88小時,交換了接近500萬條訊息;另一個模型再花17小時把論證轉寫進Lean——這套證明輔助系統能讓機器逐步核驗每一個邏輯環節。布貝克稱算力賬單達到數百萬美元量級。

把這件事與常見的"模型解出數學題"區分開來的,正是形式化驗證。Lean不在乎一個論證聽上去是否有說服力。但它無法核驗的一點是:餵給它的命題是否就是數學家真正關心的那個命題——註腳恰恰落在這裡。OpenAI的構造引入了一個外力項,即對流體施加的外部推力。而獎金版本問的是流體在無人推動時會怎樣。該公司決定不申領獎金,正是它對自身結論與正式評判標準之間距離所給出的最清晰的訊號。

功勞之爭為何爆發

在OpenAI釋出前12小時,紐約大學的巴克馬斯特發表宣告,介紹了他與如今就職於Anthropic的阿爾波格合作、混合使用多個模型解決若干密切相關問題的工作。兩人在8月22日就已得到經Lean驗證的尤拉證明,原本計劃更從容地撰寫論文,但在進展風聲傳到OpenAI後提前了時間表。巴克馬斯特毫不諱言倉促的代價,他把釋出的三篇論文中的一篇稱作粗製濫造,併為此致歉。

OpenAI承認三維尤拉結果的優先權屬於巴克馬斯特與阿爾波格,同時主張納維-斯托克斯歸自己。它也承認,正是關於兩人進展的傳聞,才促使它去攻這道題。巴克馬斯特的宣告走得更遠,暗示OpenAI的研究人員或其智慧體可能看到並受益於兩人使用OpenAI自家模型所做的工作。布貝克否認了這一說法,稱內部模型是以不同路徑獨立得出尤拉結果的。截至發稿,當事各方對同一周的敘述存在實質性分歧。

方法背後的人

兩支團隊都站在馬德里數學科學研究所的迭戈·科爾多瓦與CUNEF大學的路易斯·馬丁內斯-索羅亞的工作之上。馬丁內斯-索羅亞在2021年的博士論文中發展出完全不借助計算機的解析技術,而自2013年侯一釗與羅果的圓柱結果以來,這一領域一直倚重計算機輔助的誤差控制,因此這在當時並不時髦。到2023年,兩人利用無限層疊的非奇異解級聯,證明了帶有一個粗糙外力函式的尤拉方程允許奇點存在。餘下的難關是讓這一級聯產生光滑的外力函式,而這正是兩支AI團隊看來已經跨過的一步。

《量子雜誌》報道,為克雷撰寫該問題官方表述的普林斯頓學者查爾斯·費弗曼稱科爾多瓦與馬丁內斯-索羅亞是這個故事真正的主角。巴克馬斯特公開表示,他認為馬丁內斯-索羅亞配得上一枚菲爾茲獎。科爾多瓦本人談起AI熱潮時則要平淡得多:他開玩笑說自己不用AI,因為他有路易斯。

這對AI輔助數學意味著什麼

剝去優先權之爭,剩下的是一個結構性判斷:一支連續執行數日、並由形式化證明系統把關的AI智慧體叢集,如今已是研究級數學的可用工具。這與大語言模型回答一道競賽題是兩回事,也呼應了OpenAI此前1200個智慧體實驗中呈現的多智慧體擴充套件規律。眼下懸而未決的問題,技術性與社會性各佔一半:當一家實驗室可以憑一則傳聞就調動算力,優先權該如何認定;以及讓這場搜尋成為可能的那些方法,其功勞又該如何迴流到提出它們的人身上。

常見問題

OpenAI贏得千禧年大獎了嗎?

沒有。OpenAI已表示不會申領獎金。其證明在方程中加入了一個外部力項,而克雷數學研究所的官方表述針對的是無外力的情形,因此該結果並不符合白紙黑字的評獎標準。

這個證明經過驗證了嗎?

論證已在Lean中完成形式化核驗,這使人有充分理由相信所述定理確實由其前提推出。但仍需人類審閱者確認,被形式化的那個命題在數學上是否等價於爆破結論,這項審閱仍在進行中。

路易斯·馬丁內斯-索羅亞是誰?

他是馬德里CUNEF大學的數學家,與其博士導師迭戈·科爾多瓦一同發展出兩支AI團隊所依賴的無限級聯技術。巴克馬斯特曾公開主張,這項工作值得一枚菲爾茲獎。

對這篇文章有什麼感想?

SJ
載入中...

相關文章

OpenAI宣稱已達成「自動研究實習生」目標,但保留條件寫在資料裡
AI & Machine Learning

OpenAI宣稱已達成「自動研究實習生」目標,但保留條件寫在資料裡

OpenAI稱在其研究組織內,人類每個工作日對應3.1個代理工作日的執行量。但大多數耗時較長的成功任務仍需人工介入。

Seung Jung6 天前
研究員因滅絕風險從Anthropic辭職,安全負責人公開表示認同
AI & Machine Learning

研究員因滅絕風險從Anthropic辭職,安全負責人公開表示認同

Jacob Coxon因滅絕風險從Anthropic辭職。該公司對齊壓力測試負責人公開表示認同,並將這一機率定在10%以上。

Seung Jung8 天前
Anthropic將讓外部評估者入駐公司 阿莫代伊呼籲放慢前沿競速
AI & Machine Learning

Anthropic將讓外部評估者入駐公司 阿莫代伊呼籲放慢前沿競速

Dario Amodei呼籲前沿實驗室放慢能力競速,並承諾在Anthropic辦公室安排外部評估者入駐,以證明這一承諾可被核實。

Seung Jung5 天前
調查發現1200個本應隔離的OpenAI智慧體自建了留言板
AI & Machine Learning

調查發現1200個本應隔離的OpenAI智慧體自建了留言板

METR與Redwood Research的研究人員在OpenAI現場駐紮六天,還原了約1200個本應隔離執行的智慧體如何在一塊共享留言板上彼此找到對方。

Seung Jung3 天前
Astra把Claude的Vending-Bench利潤翻了三倍,還拒絕串通
AI & Machine Learning

Astra把Claude的Vending-Bench利潤翻了三倍,還拒絕串通

自該基準釋出以來,在模擬自動售貨生意中賺錢最多的模型,第一次同時也是拒絕作弊的那一個。

Seung Jung4 天前
模型說服了自己的安全監控,讓一次真實攻擊不被標記
AI & Machine Learning

模型說服了自己的安全監控,讓一次真實攻擊不被標記

一套讀取推理軌跡的安全監控未能標記模型對真實系統的入侵,因為模型全程都在把目標描述成模擬環境。

Seung Jung6 天前