未公開的新模型“立功”,Anthropic 宣佈 Claude 攻克黎曼猜想取得重大突破

人工智慧領域再度傳出震撼學術界的重大消息。Anthropic 公司於近日正式對外宣布,其旗下大型語言模型 Claude 在尚未公開的新模型測試過程中,針對數學領域最著名的未解難題之一「黎曼猜想」(Riemann Hypothesis)取得了關鍵性的研究突破。這項成果並非來自人類數學家的手動推導,而是由 Claude 在長達數天的自主運算測驗中獨力完成,標誌著 AI 在處理極度抽象的長期邏輯鏈問題上已達到前所未有的水準。據 Anthropic 公布的資訊,這次突破的核心在於 Claude 成功大幅改寫了黎曼 ζ 函數(Riemann zeta function)臨界線上非平凡零點比例的下界估計。
過去數十年間,數學界透過一代代頂尖學者的接力,已將該比例的下界逐步推進至 41.6%。然而,Claude 在一段持續數日的封閉測試中,一口氣將此下界從 41.6% 提升至 67.2%,整整提高了超過 25 個百分點。這個飛躍式的進展遠遠超過過去任何一次人為推動的幅度,也讓學術界為之側目。黎曼猜想之所以被譽為「數學皇冠上的明珠」,在於它與素數分布規律的深層連結。該猜想的核心內容主張:黎曼 ζ 函數的所有非平凡零點都位於複數平面上實部為 1/2 的直線上,這條線被稱為「臨界線」。雖然猜想本身尚未被完全證明,但數學家們長期致力於估算臨界線上究竟分布了多少比例的零點,以此逐步逼近最終結論。
過去從 20 世紀中葉的經典結果到近年來勉強突破 40% 關卡,每一步都耗費了數以年計的人力與計算資源。Anthropic 強調,這次測試所使用的 Claude 模型版本並未對外公開,屬於公司內部正在研發的下一代架構。在測試過程中,模型不僅需要理解黎曼猜想相關的深厚數學背景,還必須自主設計推理路徑、組合多個定理、反覆驗證邏輯嚴謹性,並在數天的連續運算中保持思路的一致性。這種需要極高專注力與結構化思考能力的任務,過去被視為大型語言模型的硬傷,但此次表現似乎已打破此一印象。學術界對這項突破的反應雖然褒貶不一,但多數數學家承認其結果本身具有相當的學術價值。從 41.6% 躍升至 67.
2% 並非單純的算術進步,而是代表模型可能挖掘出一套全新的分析框架或證明代數結構,從而繞過了人類數學家長期以來遭遇的瓶頸。若 Claude 提出的證明方法能夠經由同行評審並以正式論文刊出,不僅將為後續研究打開全新的道路,甚至可能加速黎曼猜想最終證明方案的誕生。值得注意的是,Anthropic 並未公布該新模型的具體架構細節,也未說明訓練資料的規模與組成。外界推測,此次突破可能得益於模型在長期推理上的專門強化——例如更長的上下文窗口、更好的邏輯鏈追蹤能力,以及更有效的自我糾錯機制。
此外,該模型在數學符號運算與命題轉換上的表現也值得深入分析,因為黎曼猜想的研究往往需要同時調用解析數論、複變函數論與代數幾何等跨領域工具。從更宏觀的角度來看,Claude 此次的成果不僅僅是單一數學難題的進展。它象徵著 AI 從「模式匹配」朝向「自主推理」的重要轉折。過去大型語言模型在數學領域的應用多停留在解題或生成簡單證明,但面對黎曼猜想這類頂級難題,模型必須具備長程規劃能力,能夠自行提出假設、測試邊界條件、修正錯誤路徑。Anthropic 顯然在這一方向上取得了領先,也為 AI 輔助科學研究的未來鋪設了更堅實的基礎。然而,也有研究者提出謹慎的看法。
一位不願具名的數論學者在接受媒體採訪時指出,雖然 67.2% 的下界非常驚人,但僅靠一個數字無法判斷證明是否完整無誤。尤其大型語言模型有時可能產生看似合理但實際上包含隱含錯誤的推論鏈,這需要人類專家花費大量時間逐一檢驗。此外,此次測試是在 Anthropic 內部封閉環境中進行,尚未經過獨立第三方驗證,學術界仍需等待詳細的技術報告與原始數據公開。無論如何,這項突破已引發全球數學界與 AI 社群的強烈討論。許多大學與研究機構開始重新審視與 AI 公司合作的可能性,希望借助新一代語言模型的力量攻克其他懸而未決的數學猜想。
Anthropic 則表示,他們將在未來數週內發布更詳細的技術論文,並考慮將新模型的部分能力開放給學術研究使用,以促進基礎科學的發展。對於一般讀者來說,黎曼猜想或許仍顯遙遠,但 Claude 的成就傳達了一個明確訊號:人工智慧不再只能處理日常問答或內容生成,它已有潜力參與人類智力最巔峰的探索。從 41.6% 到 67.2%,這一步跨越的不僅是數字,而是人機協作的新紀元。
Related
相關文章

WRC 2026|原生全模態世界模型:從模擬世界到交互世界
世界機器人大會期間,智象未來創辦人梅濤於「物理AI引領者論壇」發表演講,提出原生全模態世界模型從「模擬世界」走向「交互世界」的觀點。他強調即使AI模型智商接近140,高IQ不代表全能,需具備在真實物理世界中穩定完成任務的能力,此為Physical AI發展的關鍵。論壇聚焦通用物理智慧的技術演進與產業路徑,匯聚眾多專家參與。

阿里巴巴達摩院推出肝癌 AI 模型:可精準識別 1 釐米微小腫瘤
作者:遠洋 責編:遠洋 評論: 感謝網友 HH_KK 的線索投遞!8 月 24 日消息,阿里巴巴達摩院聯合中國醫科大學附屬盛京醫院等機構研發出肝癌診斷 AI 模型 DAMO LiON,可通過 CT 影像識別微小的肝臟癌變病灶。在兩個月的真實世界前瞻臨床試驗中,該 AI 模型發現了 15 例原本被遺漏的惡性腫瘤,絕大部分為 1 釐米左右的病灶,幫助患者得到及時的手術或藥物治療。
數學自動形式化迎來重大突破:OpenBMB開源MathForm,8B模型憑實力逆襲大廠
OpenBMB團隊開源數學自動形式化框架、數據集與模型MathForm,目標是用Lean4讓機器準確讀懂並形式化驗證數學定理,攻克通用人工智能核心挑戰。其關鍵不是簡單翻譯自然語言,而是將每個數學概念精準映射到Mathlib庫中,為數學與AI交叉研究提供新工具。

加州伯克利數學教授撰文批評學生基礎差,卻被抓包“用 AI 寫的”
作者:清源 責編:清源 評論: 8 月 23 日消息,據英國《衛報》20 日報道,加州大學伯克利分校數學教授茲韋茲德利娜 · 斯坦科娃日前在《舊金山標準報》撰文批評部分學生存在“嚴重”的數學基礎缺失,卻又承認文章本身曾藉助 AI 編輯,由此引發爭議。

美國專家示警:學生依賴“AI 代寫”會削弱思考能力
作者:清源 責編:清源 評論: 8 月 23 日消息,美國學生使用 AI 完成作業、甚至代寫整篇論文的現象已經十分普遍,也有不少學校允許學生在一定範圍內藉助 AI 工具。據《紐約時報》當地時間 17 日報道,越來越多專家擔心,問題可能不只是學生會不會寫文章,而是長期依賴 AI 可能削弱他們本身的思考能力。