難評!OpenAI剛官宣的NS方程大突破,被數學家手撕了

量子位
09/09

聞樂 發自 凹非寺

數學史級別的大新聞,愣是被OpenAI整成了一出連續劇。

剛被數學家指控搶成果,OpenAI緊急官宣:

一個尚未發布、能力顯著超過GPT-6 Astra的內部模型,已經解決了納維–斯托克斯存在性與光滑性問題

這是懸賞100萬美元的七大千禧年難題之一,之前只有龐加萊猜想成功下榜。

現在,OpenAI宣佈第二道也被拿下了。

陳立傑表示今年年初加入OpenAI時他還預測AI在2028年能解決千禧年難題,沒想到進度條直接被AI拽飛了——

5月破一個,9月一次破倆。

而且吧,OpenAI話裏話外還劇透了下一代模型:

真正完成證明的不是GPT-6,是OpenAI一個仍在訓練中的內部模型,能力比剛發布沒幾天的Astra還要更更更強。

Astra這次只能排在後面,負責檢查作業。(doge)

為了做出這道題,OpenAI直接搖來約1萬個Agent,並行工作88小時,發出270萬條消息,消耗了約1300億輸出Token。

Agent寫完證明之後,GPT-6 Astra又跑了17小時,將整份證明形式化成Lean版本,逐步檢查裏面有沒有漏洞。

《科學美國人》上來就是一句:

這可能是數學界至少20年來最重要的一天。

話都說到這個份上了,AI數學屬於是直接一腳踹開歷史大門了!

然而還沒等數學圈把掌聲送出去,事情就開始變得不太對勁……

傳聞OpenAI之所以突然出手,是因為聽說外面有人快做出來了。

而那個被搶先的團隊,此前一直在使用OpenAI Codex,尚未公開的草稿、證明和中間推導都放在裏面。

緊接着,OpenAI還被指控想把其中一名Anthropic研究員從作者名單裏拿掉。

不er,咱們剛纔討論的,真的是數學證明對吧???

1萬個Agent,88小時拿下一道千禧年難題

先說說OpenAI到底證明了什麼。

納維–斯托克斯方程描述的是流體如何運動。

浴缸排水口的旋渦、飛機周圍的氣流、血液在血管中的流動,乃至天氣系統的變化,背後都能看到它。

但數學家近百年來始終無法證明:

一個最開始平滑、正常的三維流體,在方程描述下,會不會永遠保持平滑?

還是說,它可能在有限時間內突然出現「奇點」,讓速度等數值衝向無窮大?

後者在數學裏通常被稱為有限時間爆破

現實中的流體當然不可能跑出無限速度。如果這種奇點真的能夠出現,就意味着在某些極端情況下,納維–斯托克斯方程就無法繼續作為連續介質模型描述流體。

這個問題從1934年一直懸到今天。2000年,克雷數學研究所將其列入七大千禧年難題,誰能證明它永遠平滑,或者找出一個會爆破的反例,誰就能拿走100萬美元。

而OpenAI這次給出的答案是:

真的會爆

其構造了一種最初處於靜止狀態的平滑流體,並對它施加平滑外力。

流體內部的旋渦不斷向中心收縮、拉長,像一把越擰越細的意大利麪;與此同時,旋轉速度持續增大,最終在有限時間內衝向無窮大。

而在整個過程中,流體的總能量依舊保持有限。

OpenAI表示,這份證明完成了克雷研究所官方題目中的C和D兩種情況,納維–斯托克斯千禧年難題就此解決。

不過,這個找答案的過程就比較有看頭了。

9月1日,OpenAI聽到傳聞,說可能有人解決了千禧年難題。

恰好公司正在訓練一個新的內部模型,在數學測試中表現出「前所未有」的能力,於是乾脆把尚未解決的千禧年難題全部扔給它試了一遍。

不同Agent群組分別負責不同版本的問題,可以讀取緩存的互聯網資料、運行代碼,並在組內交換髮現。

最初,近100個Agent花費約50小時,先解決了一個相對簡單的無外力歐拉方程爆破問題。

OpenAI一看這條路線有戲,立即把其他題目的Agent全部調了過來。

Agent們一邊嘗試不同方法,一邊由Codex匯總各組的有效線索,再把中間成果重新分發,參與規模隨後膨脹到約1萬個Agent。

88小時之後,證明出現了。

全程總計產生490萬條Agent消息和約*3000億輸出Token,其中納維–斯托克斯一題就喫掉了1300億Token。

OpenAI還透露,這次實驗花費了數百萬美元。

百萬美元的題,用數百萬美元的算力解出來……

好消息是題做出來了,壞消息是獎金好像連電費都報不了(doge)。

當然,OpenAI也明確表示不準備領取這100萬美元。

但故事到這裏,另外兩名研究人員坐不住了。

OpenAI到底從哪裏學會了這條路線?

紐約大學數學家Tristan Buckmaster和Anthropic研究員Levent Alpöge,過去一年一直在研究流體方程爆破。

他們走的,正是後來被OpenAI用於攻克納維–斯托克斯的方向:

通過足夠平滑的外力,構造有限時間爆破。

這條路線最早來自數學家Diego Córdoba和Luis Martínez-Zoroa。

兩人已經沿着這個方向研究多年,只是此前得到的外力還不夠平滑,距離真正完成題目仍差着關鍵一步。

Buckmaster和Alpöge接棒後藉助Claude、Codex等模型繼續往前推。

8月15日,這兩位取得突破,證明三維不可壓縮歐拉方程、Boussinesq方程和不可壓縮多孔介質方程,在平滑外力作用下都能發生有限時間爆破。

8月22日,歐拉方程結果通過Lean驗證。

陶哲軒看完之後,也給出了相當高的評價:

「一項了不起的成就。」

陶哲軒進一步判斷,從這套方法繼續推進到帶黏性的納維–斯托克斯方程,目前看不出有什麼根本性障礙。

翻譯一下就是:

Buckmaster和Alpöge雖然還沒有正式拿下納維–斯托克斯,但路已經快鋪到大門口了。

兩人原本計劃再花幾周,把證明好好整理一下再發布,主要是AI給出的原始版本,實在太難讀了。。。

即使經過整理,公開版本依舊只能被稱為「AI垃圾」。

所以兩人當時的想法是,成果可以晚幾天,至少先把論文改得像人寫的。

結果硅谷顯然不太講究這種節奏,他們沒等到慢慢修稿的機會。

9月初,「Anthropic解決了重大數學難題」的消息開始流傳。

9月1日,OpenAI聽到風聲,啓動Agent項目。

9月3日,Buckmaster主動聯繫OpenAI,解釋他們尚未解決納維–斯托克斯,並透露成果即將發布。

9月5日,OpenAI的1萬個Agent完成證明。

也就是說,數學家還在修改AI草稿,OpenAI已經把1萬個Agent和數百萬美元算力壓了上去,一腳油門衝過終點。

然後,問題來了。

Buckmaster和Alpöge在研究期間一直在使用Codex,並將論文草稿與大量推導放進了會話。

當OpenAI給出的結果恰好也是這條少有人走的「平滑外力」路線時,Buckmaster立即警覺起來,並詢問OpenAI:

內部模型是否訪問過他們的Codex會話,或者是否在訓練中使用了這些數據?

按照Buckmaster的說法,他得到的回答是,模型沒有主動檢索用戶數據;但當他繼續追問訓練數據問題時,沒有得到明確回應。

OpenAI則公開否認研究人員或Agent查看過兩人的工作,稱直到論文公開後才接觸到具體內容。

不過,它同時留下了一句非常微妙的表述:

雖然可能性很低,但無法排除兩人使用OpenAI產品產生的去標識化數據曾幫助改進模型。

好傢伙,沒有專門翻你的論文,但不保證模型沒有從你使用產品留下的數據中受益……

這下,事情徹底從數學問題變成了AI時代的學術產權問題。

AI助手用着用着,變成競爭對手了。

「把Anthropic的人從作者名單裏拿掉」

接下來發生的事兒更火藥味十足。

根據Buckmaster公開的四頁聲明,OpenAI在得知雙方研究方向接近後,曾向他提出兩套發布方案。

第一套:

Buckmaster和Alpöge先公開歐拉方程成果,OpenAI第二天再發布納維–斯托克斯證明。

第二套:

由Buckmaster出面撰寫論文,公布OpenAI內部模型得到的納維–斯托克斯結果。

但Buckmaster稱,OpenAI研究員Sebastien Bubeck兩次表示,希望把Alpöge排除在作者名單之外。

為啥呢?

原因很簡單,Alpöge就職於Anthropic

數學成果可以談,競爭對手的人,不太方便上桌。

Buckmaster拒絕了兩種方案,並表示如果OpenAI按照這種方式發布,自己會把整個過程公開。

然後,對話開始逐漸從數學論文滑向硅谷商戰片……

據Buckmaster轉述,OpenAI反問Buckmaster

你為什麼要毀掉自己的職業生涯?

Buckmaster人家也很納悶,我是一個學者,把事實公開,怎麼就叫毀掉職業生涯?

對方則回覆:

「如果你不希望我保持友善,那我也不必友善。」

嚯,咱就是說偏微分方程沒聽懂,但這威脅的意思倒是挺光滑的(doge)

不過,Buckmaster也非常謹慎地劃清了範圍:

他沒有看過OpenAI的證明,不知道內部模型具體做了什麼,也不知道兩人的數據是否真的被使用。

因此,他也並沒有直接指控OpenAI竊取成果,只是把自己聽到的話、事情發生的時間和收到的提議全部公開了。

很快,OpenAI的這位Sebastien大哥也回應了,而且按照他的版本,整件事情完全是另一個畫風。

Sebastien首先表示,自己聯繫Alpöge,本來是想協調雙方的發布時間,避免OpenAI搶發,並儘可能認可兩人在歐拉方程上的成果。

「毀掉職業生涯」這句話,是說過,但沒有威脅意味,也道歉了。

至於「把Anthropic的人從作者名單裏拿掉」,他認為Buckmaster混淆了兩份工作。

Sebastien強調,自己從未要求將Alpöge從他和Buckmaster自己的歐拉方程論文中除名

當時討論的是另一個方案:

由Buckmaster擔任主要作者,幫助重新撰寫OpenAI內部模型生成的納維–斯托克斯證明。

正是在這個語境下,Bubeck才表示:

如果Levent不是Anthropic員工,事情會簡單得多。

他的理由是,讓一名Anthropic員工署名OpenAI內部模型完成的工作,這不太合適吧。

尤其兩人的歐拉方程證明還使用過Anthropic內部模型。。。

所以是否認了「要求把Alpöge從研究中除名」,但不想讓人家署名OpenAI的研究也是真的。

你們這個硅谷,還真是有節目。

OpenAI真把這道題解了嗎?

這事兒吧,其實還有一個問題,OpenAI解決的真是大家平時理解的那道納維–斯托克斯難題嗎——

算是吧,但又不完全是。

OpenAI證明的並非是核心的問題,「沒有外力時,流體自己會不會爆」。

它證明的是,在施加一個精心構造、但始終保持平滑的外力之後,流體會在有限時間內形成奇點。

從克雷研究所公布的正式題面來看,C和D兩種情況確實允許存在平滑外力。

所以,只要證明最終經受住數學界檢驗,OpenAI確實完成了題目白紙黑字寫下的要求。

這點沒法硬說人家不算。

但過去幾十年,數學家真正關心的核心版本,通常是無外力情況下,三維納維–斯托克斯方程能否自己形成奇點。

於是現在的局面就有點微妙了。

按照官方題面,OpenAI可能已經通關;

但按照大家腦海裏默認的終極版本,它打的又不完全是同一個Boss。

只能說,大家通常討論的無外力納維–斯托克斯正則性問題,還沒有大結局。

但不管這場爭議最後怎麼收場,OpenAI展示出來的能力還是有點嚇人,甚至已經開始和數學家搶時間了。

數學界那麼多懸賞,還有多少會變成AI的電費呢?

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10