AI Newsway

OpenAI想要一個顧問委員會,九位數學家自己組了一個

數學與AI顧問小組不支薪、公開發表建議,但沒有任何權力能讓OpenAI慢下來。

|5分鐘閱讀0
Fuld Hall at the Institute for Advanced Study in Princeton, New Jersey, which is hosting the new Advisory Group on Mathematics and Artificial Intelligence.
Fuld Hall at the Institute for Advanced Study in Princeton, New Jersey, which is hosting the new Advisory Group on Mathematics and Artificial Intelligence.

九位數學家在美國紐澤西州普林斯頓高等研究院(IAS)成立了一個關於數學與人工智慧的獨立顧問小組。創立聲明把話說得很清楚:這並不是OpenAI最初提議的那種安排。該公司曾接觸其中幾位成員,邀請他們加入外部顧問委員會,而他們選擇自己組一個小組,再由自己邀請其餘成員。

重點整理

  • 數學與人工智慧顧問小組列出九位創始成員:Timothy Gowers、Edward Witten、Martin Hairer、Ravi Vakil、Melanie Matchett Wood、Ulrike Tillmann、Camillo De Lellis、François Charles與Nikhil Srivastava,所有人都不因這項工作領取報酬。
  • OpenAI表示,寫出納維-斯托克斯報告的同一個內部模型,如今又解開了橫跨數學多數領域的一百多個未解問題。
  • 小組對OpenAI把數學研究推進得多快毫無置喙餘地,第一項具體任務是就這批成果該如何發布提供建議。

數學家為什麼婉拒企業的顧問委員會

這群人劃的界線在結構,不在說法。小組表示自己獨立於任何AI公司運作,成員不收報酬,建議會發表在自家網站上,而不是透過贊助者私下傳遞。它也把建議的對象開放給任何模型足以撼動數學的AI公司,不只是OpenAI

它沒有主張的是影響力。小組明白表示自己在任何AI公司都沒有決策權,各公司決定的責任仍在各公司身上。OpenAI的公告從另一端劃出同一條界線,指小組的職責不包括建議公司如何拿捏內部數學研究的推進節奏。

在這些限制之內,職權範圍仍然很廣:評估新成果的重要性、就成果如何溝通與協調提供意見、對數學研究的學術與專業標準表態,以及建議AI工具該如何支援數學家,而不是取代他們。

導火線

小組是在一場公開爭議的中途登場的。9月11日,二十五位費爾茲獎得主連署聲明,主張各家AI實驗室搶著公布著名難題解答的競賽正在傷害這門學科。他們寫道,被壓縮的發表節奏不留下撰寫論文與引用的空間,並引發嚴重的歸屬與抄襲問題;而且光有正確答案,並不足以構成數學研究的價值。這份聲明沒有提出規則,也沒有任何強制機制,並開放後續連署。

那封信與新小組的重疊很薄。TechCrunch報導指出,九位創始成員中只有De Lellis簽了名。有意思的正是這道落差:如今正式就發布方式向OpenAI提建議的人,大致上並不是那些公開質疑既有發布方式的人。

眼前的工作相當具體。小組表示,它受邀就OpenAI宣稱由內部模型產出的大量重要數學成果,協調發布的方式與順序——正是本月稍早那個帶著但書登場的納維-斯托克斯解法背後的模型。小組也開放表單,向第一線數學家徵詢這批成果該怎麼發布。

接下來看什麼

因為小組會公開發表建議,第一個真正的訊號從外面就看得到:一份關於那一百多項成果如何發布的公開建議,接著是OpenAI實際做了什麼。一個無給職、沒有否決權的機構,很容易被當成裝飾。但一個把建議白紙黑字寫在公開場合的機構,同時也替每一次建議被無視留下了紀錄。

它擺上檯面的更大問題是:解開一道題,和對一個領域做出貢獻,是不是同一件事。這不是基準測試分數能了結的問題,也不是大型語言模型能替自己回答的問題。

常見問題

數學與人工智慧顧問小組隸屬於OpenAI嗎?

不是。小組表示自己獨立於任何AI公司運作,成員也不因這項工作收取報酬。它是在OpenAI接觸部分成員、提議成立外部顧問委員會之後成立的,並表示願意為其他模型顯著影響數學的AI公司提供建議。

小組能阻止OpenAI發布AI產生的數學成果嗎?

不能。小組已表明自己在任何AI公司都沒有決策權,OpenAI也說明小組不負責就其內部數學研究的節奏提供意見。它的影響力只能透過公開的建議,以及成員本身的聲望分量來發揮。

OpenAI說它的模型解開了多少未解問題?

OpenAI表示,內部模型已解開橫跨數學多數領域的一百多個未解問題,這還不包括先前公布的納維-斯托克斯千禧年大獎難題解法。這些主張並未以同等速度通過同儕審查,而這正是數學家提出異議的主要原因之一。

對這篇文章有什麼感想?

SJ
載入中...

相關文章

DeepMind 百個代理分裂成作弊者與吹哨者
AI & Machine Learning

DeepMind 百個代理分裂成作弊者與吹哨者

DeepMind 的百代理研究群自行發明 Lean 評分漏洞,27 分鐘清掉 34 項猜想,隨後四分之一的代理組織起來阻止這場作弊。

Seung Jung7 天前
25輪施壓測試:大模型紛紛讓步,推理過程卻守住了正確答案
AI & Machine Learning

25輪施壓測試:大模型紛紛讓步,推理過程卻守住了正確答案

arXiv 上的新基準 SPINE 與模型爭論最多 25 輪。受測的七個系統無一例外,對話越長,讓步率越高。

Seung Jung8 天前
調查發現1200個本應隔離的OpenAI智慧體自建了留言板
AI & Machine Learning

調查發現1200個本應隔離的OpenAI智慧體自建了留言板

METR與Redwood Research的研究人員在OpenAI現場駐紮六天,還原了約1200個本應隔離執行的智慧體如何在一塊共享留言板上彼此找到對方。

Seung Jung7 天前
GPT-6-Astra在重建的對齊評測中20次裡有18次鑽了空子
AI & Machine Learning

GPT-6-Astra在重建的對齊評測中20次裡有18次鑽了空子

在推理模型寧可改寫棋盤檔案也不肯認輸被揭露一年半後,新的蜜罐測試顯示這種行為只是換了個地方。

Seung Jung8 天前
Microsoft白紙黑字寫下自家AI模型絕不可越過的紅線
AI & Machine Learning

Microsoft白紙黑字寫下自家AI模型絕不可越過的紅線

Microsoft AI釋出行為準則草案,明確自家MAI模型絕不可做的事,並將其位階置於企業運營方與使用者政策之上,公開徵求意見六週。

Seung Jung7 天前
DeepMind預先算出90億個DNA變異,匯成1PB圖譜
AI & Machine Learning

DeepMind預先算出90億個DNA變異,匯成1PB圖譜

解讀人類基因組的瓶頸從來不是測序,而是判斷約90億種可能的單鹼基改變中,究竟哪些真正起作用。

Seung Jung8 天前