Anthropic Claude 刷新物理學世界紀錄:單挑基於楊振寧理論 9 圈難題

2026年9月26日 23:44
Anthropic Claude 刷新物理學世界紀錄:單挑基於楊振寧理論 9 圈難題
站內 AI 整理稿

首頁 > 智能時代>人工智能 Anthropic Claude 刷新物理學世界紀錄:單挑基於楊振寧理論 9 圈難題 新智元 2026/9/26 23:44:10 責編:問舟 評論: Anthropic 官宣,Claude 拿下了理論物理的一項前沿紀錄。它在幾乎無人類干預的情況下,連續運行數天,一舉攻克了高能物理學界出了名難算的「九圈散射振幅」計算難題!具體來說,它算出了平面 N=4 超楊-米爾斯理論裡六粒子振幅的九圈結果,人類此前的紀錄停在八圈。注意,楊-米爾斯模型(Yang-Mills)其中的「楊」,指的正是物理學泰斗楊振寧先生。

他與米爾斯在 1954 年共同創立的「楊-米爾斯理論」,是整個現代粒子物理學的基石。基於它的任何高階計算,都堪稱人類腦力的極限挑戰。如今,人類頂尖理論物理學家,就這樣被 AI「截胡」了。更可怕的是,Claude 完成這項神級挑戰,僅僅只用了一個提示詞,花了幾千美元!幾天後交回的答案,光其中一部分展開就有 300 億項。看起來,科學界的低垂果實,比想象中要多得多啊。這次,負責給 AI 驗證結果的物理學家 Lance Dixon 這樣感慨:我身邊的大多數理論物理學家其實早就承認,大模型遲早會顛覆物理學,只是不知道那一天什麼時候砸到自己頭上。對我來說,那一天是 9 月 1 日。

硬核物理學家挑釁 AI「我的老本行很特殊」故事的起因,源於一位物理學家的「挑釁」。Matt von Hippel,曾經是一位理論粒子物理學家,現在是一名科普作家。2016 年的五圈、2019 年的六圈和七圈,論文作者名單裡都有他的名字面對最近的 AI 新聞,他表示不信邪,除非親眼看到大模型解決自己領域的難題。深藍贏了國際象棋大師卡斯帕羅夫,圍棋界說:圍棋太複雜,電腦下不了。結果被 AlphaGo 打臉。AlphaFold 碾壓人類蛋白質結構專家,但其他領域說:我們沒有那種數據,複製不了。現在,大語言模型能讀文獻、能模仿數學證明。但爭論依舊不斷:AI 是不是隻會找反例,提不出新框架?

是不是隻在數學這種規則清楚的領域管用,物理這種模糊領域不行?……每次都是同一個套路:學者先懷疑,直到 AI 殺進他們自己的領域。他認為他的老本行「散射振幅」,不一樣。上個月,他在自己的博客上向全網 AI 公司發下了一封「英雄帖」:如果你們 AI 公司真的想震撼我們這些科研人員,就來挑戰我的老本行吧!請證明 AI 能在普通學者能夠負擔得起的計算預算內,解決散射振幅領域懸而未決的難題。他一共出了三道題,其中一道便是:給我把 N=4 超級楊-米爾斯模型(N=4 super Yang-Mills)算到第九圈(Nine Loops)!

在理論物理學中,物理學家們通過「散射振幅」的公式來預測粒子的行為,比如大型強子對撞機裡的粒子怎麼撞。散射振幅但這個公式簡直是噩夢。為了無限逼近真實答案,物理學家必須一層一層地疊加被稱為「圈」精細修正層。每多加一個「圈」,答案就更精確,但計算量是呈指數級爆炸增長的!實際操作中,大多數人類停留在第二圈或第三圈。粒子物理學中最精確的預測,也才用到了第五圈。而在特殊的「測試沙盒」模型中,人類目前的極限紀錄是「八圈」。這是由 SLAC 國家加速器實驗室的大牛教授 Lance Dixon 和團隊多年死磕才拿下的。「九圈」?看起來是需要海量算力和無數天才大腦耗費數年才能觸及的領域。

Matt 給 AI 的挑戰,就是這麼簡單粗暴。一句提示詞,幾千美元,Claude「殺瘋了」面對這種公開叫板,Anthropic 的科學家們,悄悄接下了戰書。八月底,Anthropic 的兩名物理學家員工 Liam 和 Siddharth 悄悄聯繫了 Matt:「嗨,你的挑戰,我們搞定了。」Matt 當場驚掉下巴。怎麼做到的?燒了上百萬美元的算力嗎?並沒有。研究團隊用的是 Claude Science,一個專門為科學家設計、能讓 Claude 遵循嚴謹規則運行的系統,模型是目前最強的公開可用模型 Fable 5.1。

他們給 Claude 輸入了一個簡單的 Prompt:現在的問題是:計算平面 N=4 SYM 模型在九圈下的六粒子(六邊形)振幅。然後,研究員並沒有手把手教 Claude 怎麼做,而是給它留了一句話:我要去睡覺了,接下來的幾個小時我都不會在。你繼續算,除非我叫你停,每隔 4 到 6 小時給我彙報一次進度。然後,Claude 就在無人值守的情況下,開始了瘋狂的推演!它運用了 Dixon 和合作者這些年開發的一種叫做「自舉」的方法,就像解一場數獨遊戲一樣,在無數參數中不斷排除錯誤選項。幾天後,Claude 不僅算出了九圈,而且是用了兩種不同的物理方法(原始自舉法和間接形狀因子法)分別算出來的!

具體來說,在原始自舉法中,Dixon 團隊用的方法叫 bootstrap,類似於數獨,把所有可能的函數全填進格子裡,用物理法則一個個排除,剩下的就是答案。Claude 直接掏出 Python 和開源庫 SymPy,在六粒子振幅的空間裡硬算出了一條血路。在間接形狀因子法中,當年 Dixon 他們衝八圈時,先算了個簡單的「形狀因子」,再利用一種奇特的「對蹠對偶」對稱性,把結果翻譯成振幅。Claude 順著這套打法,往上又生推了一圈。形狀因子這一路,Claude 沒有算一個費曼積分。它把整個物理問題變成一個超大的方程組,全程用整數求解,不會有小數誤差,還能換幾個大素數反覆驗算。第一道坎是內存。

照老辦法推到九圈,光未知數就有 185 萬個,方程組大到內存根本裝不下。Claude 換了個思路,借對蹠對偶先把答案的一部分「猜」出來,再加上對稱性,未知數一下從 185 萬降到了 7.6 萬個。接下來就是解「數獨」。7.6 萬個未知數,被物理規則一輪輪排除,最後只剩唯一解。最後翻譯回振幅,光一個切面上的結果就有 300 多億項,八圈時才 16.7 億項。而且,解決人類物理學界的懸案,花費極低。按普通用戶的價格算,每條路要一兩千美元,兩條加起來幾千美元,大頭是 Claude 長時間運行的費用。

而直接自舉那一路,純粹用於運行 Python 代碼的算力成本,僅僅只有 100 美元 —— 這隻相當於租用了 96 個 CPU 跑了一個星期。100 美金,一句提示詞,Claude 在幾天內就輕而易舉地捅破了理論物理學的天花板。前世界紀錄保持者:「被 AI 截胡了,但我很興奮」結果算出來了,但對不對呢?Anthropic 的團隊找到了「八圈」紀錄保持者 ——Lance Dixon 教授本人來驗算。那天是 9 月 1 日,巧的是,正好也是 Fable 5.1 發佈當天。Dixon 教授拿到結果的那一刻,內心是極為震撼的。因為他太知道這有多難了。

從 2023 年算完八圈之後,他和他的團隊這兩年一直在一籌莫展地死磕九圈。整個計算過程就像是在搭一個撲克牌城堡,或者烤一個舒芙蕾,中間只要有一個代碼寫錯、一個符號標反,整個計算就會徹底崩潰。但 Claude 不僅沒有崩潰,還從頭開始自己把所有繁瑣的代碼全寫了,完美避開了所有的坑!經過長達兩週的仔細驗證,Dixon 教授確認,Claude 的九圈結果正確無誤!那麼 Dixon 教授感到心碎嗎?「不會,」Dixon 教授在博文中豁達地寫道,理由有兩個。一是他們團隊本來就在訓練定製的 transformer 模型預測更高圈數,口號是機器給出的任何候選答案都有工具驗證。

Claude 也是 transformer,只是大概比他們的大一百萬倍。二是 Claude 用的全是他和合作者這些年開發的方法,交答案時還用了他們團隊早就定好的格式(教授猜,這是 Claude 在給他們賣面子)。我在驗證 Claude 的結果,Claude 也在驗證我們過去所有的工作。他還給出了一個極高的評價:除了我和我的合著者,Claude 可能是這個世界上最懂我 2019 年和 2023 年發表的論文的「人」了。而他的同組大佬 Kyle Cranmer 還在 X 上凌亂,「剛發現我們組被 Anthropic 搶發了,我還在消化…… 雖然不算太意外,但我真希望當初我們能有時間和資源投進去。

」極限反轉中國團隊靠 GPT-6 也殺到了九圈有趣的是,Anthropic 剛找完出題人 von Hippel 沒幾天,他又收到了另一個重磅消息 —— 來自中國科學院理論物理所的何頌團隊。何頌是國內散射振幅領域的大牛,近年代表性工作包括提出量子場論散射振幅的 Cachazo-何-袁形式,開創性地發現場論和絃論散射的幾何起源,並在場論高圈計算和嚴格求解,規範場、引力和絃論的對偶等方向做出了一系列重要工作。就在 9 月 17 日,何頌、景繼榮、李想把六粒子振幅從二圈到九圈的核心骨架數據,公開掛上了學術平臺 Zenodo。論公開發布時間,比 Anthropic 官宣還早了 8 天!

何頌團隊同樣用上了 AI。Dixon 透露,GPT-6 幫中國團隊算了一部分約束條件,不過整體框架還是人類自己搭的。von Hippel 也確認,他們確實用了 GPT-6 做輔助,但絕不是 Anthropic 那種純 AI 打法。Dixon 自嘲說,「大家好像就是喜歡跑來告訴我,他們把九圈給搞定了。這下好了,我先被一臺機器搶發,轉頭又被『人類 + 機器』聯手搶發了一次。」前不久 OpenAI 宣佈攻克千禧年難題納維-斯托克斯方程、Claude 推進黎曼猜想的一個關鍵下界的時候,就有人這樣問:為什麼 AI 只去攻克數學難題,不去攻克物理難題?現在,這不就來了麼。

雖然 Claude 算出的只是 N=4 超級楊-米爾斯的「玩具模型」,距離解釋真實宇宙的暗物質、反物質還有很長的路要走,但它的象徵意義是空前的。這就像是 AlphaGo 第一次戰勝李世石。大家驚呼的,是機器居然能掌握屬於人類直覺的領域。Dixon 教授留下了一句耐人尋味的話:大型語言模型能夠執行我們設定的複雜配方並組織計算,這是一個巨大的勝利。但當有一天,大語言模型開始在人類之前提出新的物理學原理和洞察力時,那才是真正觸及人類靈魂的時刻。或許,現在已經遍地都是低垂果實。參考資料:https://x.

com/ anthropicai / status/2103541577083719888https://www.anthropic.com/ research / yes-claude-can-do-nine-loopshttps://itp.cas.cn/ sourcedb / zw / zjrck / dsjs/201509/t20150910_4423219.htmlhttps://arxiv.org/ pdf/2602.

12176 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Claude,AnthropicNothing Headphone (a) 頭戴式耳機被曝 3 月上市,提供粉 / 白 / 黑 / 黃四種配色【開箱】華碩a豆14 2023 圖賞:潮色時尚設計,高能暢快辦公【評測室】華碩a豆14 2023 評測:擴展性拉滿的潮色高能輕薄本【評測室】華碩a豆14 Pro 航天聯名款評測:12 代標壓強勁性能,定製元素探索星河華碩新款 a 豆 14 Pro 輕薄本開啟預售,清新配色 + 12 代標壓酷睿,預售優惠價 4499 元起消息稱三星 2022 年發力中端,將為更多 Galaxy A 系列手機帶來防水功能

Related

相關文章

IT之家生成式AI

從代碼分析到授權爭議:一用戶用 AI 破解 IDM 引發爭議

作者:問舟 責編:問舟 評論: 9 月 26 日消息,據 Wccftech 報道,一則關於“大語言模型破解付費軟件”的帖子今日在 Reddit 上引發關注。用戶 No_Ideal8394 聲稱,他利用無審查限制的 Qwen3.8-Flash-Next-Uncensored,成功破解了 Internet Download Manager(IDM)6.

剛剛
量子位生成式AI

筆記本跑7000億參數GLM!無GPU也行? SSD當顯存用火爆GitHub

GitHub爆紅的開源推理框架Colibrì以純C語言開發、零引擎依賴,透過將暫時用不到的模型權重存放在SSD、需要時再載入記憶體的方式,讓筆電不需GPU也能執行超大規模MoE模型。目前該框架已累積超過3.2萬星數,支援GLM-5.2、DeepSeek V4 Flash、Kimi K3等9個模型家族,其中744B參數的GLM-5.2僅需約16至24GB記憶體即可運作,2.8T參數的Kimi K3也只要32GB記憶體就能挑戰。

剛剛
量子位生成式AI

在雲棲大會,我終於看懂了米哈遊千億AI野心

米哈遊在雲棲大會上揭露其AI遊戲布局,計畫未來三年投入最高千億元於AI領域,並展示AI角色對話與AI桌遊等新玩法。公司目標是讓AI進入遊戲並透過玩家互動反哺AI發展,展現其對AI技術的長期野心。

1 小時前