突發:Claude挑戰黎曼猜想「失敗」,卻意外刷新37年數學紀錄

人工智慧模型 Claude 近日接受了一項極具挑戰性的任務——嘗試攻克數學界最著名的未解之謎「黎曼猜想」。雖然最終未能如外界預期般證明或推翻這道跨越百年的世紀難題,卻在反覆試錯的過程中意外刷新了一項保持長達 37 年的數學紀錄,為 AI 在純數學領域的應用開啟了全新視角。黎曼猜想由德國數學家黎曼於 1859 年提出,核心在於探討質數分布與黎曼 ζ 函數零點之間的關係。一個多世紀以來,無數數學家為之廢寢忘食,卻始終未能找到完整證明,也因此成為克雷數學研究所列出的「千禧年大獎難題」之一,懸賞百萬美元。Claude 此次的挑戰無異於以 AI 之矛攻數學之盾,事前便在學術界與 AI 社群引發熱烈討論。
據了解,這場實驗共耗費了 3100 萬個 Token,並經歷了高達 650 次的失敗。所謂 Token 是 AI 模型處理文字或符號的基本單位,3100 萬個 Token 意味著 Claude 在長達數百次的迭代中,反覆運算、推導、驗證與修正,幾乎等同於將數萬頁數學論文的推演過程壓縮進一次大規模運算中。每次失敗後,系統便會調整策略,嘗試新的推理路徑,最終在龐大的搜尋空間中意外觸及了另一項尚未被破解的數學極限。儘管 Claude 並未直接攻克黎曼猜想,但其在推理過程中展現出的運算能力與邏輯鏈,卻成功將某項未被公開名稱的數學紀錄往前推進——這項紀錄已經塵封 37 年之久。
研究人員發現,Claude 在處理某個特定數學結構時,產生了以往人類數學家從未抵達的計算結果,該結果在經過驗證後證實為有效,從而刷新了舊有紀錄。這個意外收穫讓參與實驗的科學家大感意外,也讓外界開始重新審視大規模語言模型在純數學領域的真正潛力。目前學術界與 AI 社群正積極分析 Claude 此次完整的運算歷程,尤其是那 650 次失敗中可能隱藏的數學洞見。許多研究人員認為,失敗並非無意義的試錯,每一次錯誤推導都可能揭示某個未被注意的數學關係,甚至成為通向新定理的線索。
這樣的觀點也呼應了近年來「AI 輔助數學發現」的趨勢——例如 DeepMind 的 AlphaFold 在蛋白質結構預測上的突破,以及 OpenAI 的 o1 模型在競賽數學題中展現的推理能力。回顧歷史,37 年是一段不短的歲月。上一次這項紀錄被打破時,個人電腦尚未普及,數學證明仍主要依靠紙筆與黑板。如今 Claude 以 3100 萬 Token 與 650 次失敗的代價換來一次紀錄刷新,背後反映的是大型語言模型在處理高度抽象、非結構化數學問題時,具備了人類難以企及的試錯效率與路徑探索能力。
雖然目前尚無法斷言這是否預示著 AI 將能獨立證明黎曼猜想,但至少證明了一點:即使面對頂尖難題,AI 仍可能在不經意間帶來無法預期的突破。值得注意的是,Claude 此次實驗並非單純的「暴力計算」。據了解,系統在嘗試過程中採用了多種推理框架,包括符號運算、歸納類比與反證法鋪陳,每當某一條路徑陷入死胡同,模型便會主動回溯並切換策略。這種動態調整的過程,與人類數學家面對難題時的思考方式極為相似,但速度和規模遠非人力所及。研究人員也指出,Claude 之所以能在失敗中捕捉到新的紀錄,正是因為它從未重複完全相同的錯誤,每一次試錯都產生了獨特的數學表徵。然而,黎曼猜想仍然懸而未決。
克雷數學研究所的獎金依舊無人能夠領走,全世界數學家仍在等待那道劃時代的證明。Claude 這次的表現雖然振奮人心,卻也凸顯了當前 AI 在面對「非構造性」或「需要全局洞察」的數學命題時,仍存在本質上的局限性。它擅長在既定規則內進行大規模搜尋與模式識別,但對於需要跳出框架、創造全新數學結構的突破,仍然力有未逮。不過,部分數學家認為,Claude 此次刷新紀錄的意義,可能比單純破解黎曼猜想更具啟發性。因為破解一個難題往往是終點,但在試圖破解難題的過程中意外發現新的數學風景,反而能開拓更多未知的研究方向。
AI 的「意外發現」本質上類似於人類科學史上的「serendipity」(偶然機遇)——從巴斯德到弗萊明,許多重大發現都來自「失敗」的實驗。如今 Claude 以 650 次失敗換來一次紀錄更新,或許正是 AI 版「偶然發現」的開端。隨著大規模語言模型持續進化,未來可能會有更多類似實驗出現。各家 AI 公司與學術機構早已積極探索如何讓 AI 參與數學研究,從自動化證明、反例搜尋到猜想生成,每一步都可能改寫數學發展的節奏。Claude 這次的表現,無疑為這條道路鋪設了一塊重要的里程碑。
總結來看,Claude 挑戰黎曼猜想雖然未能如願「封神」,卻在無心插柳中刷新了一項 37 年的數學紀錄,向世人展示了 AI 在純數學領域的潛力與不可預測性。3100 萬個 Token、650 次失敗、一次意外突破——這些數字背後,是一個正在快速成長的人工智慧,以及數學這門古老學科擁抱新時代的契機。至於黎曼猜想本身,或許仍需要等待下一個天才或下一世代 AI 的降臨。
Related
相關文章

WRC 2026|原生全模態世界模型:從模擬世界到交互世界
世界機器人大會期間,智象未來創辦人梅濤於「物理AI引領者論壇」發表演講,提出原生全模態世界模型從「模擬世界」走向「交互世界」的觀點。他強調即使AI模型智商接近140,高IQ不代表全能,需具備在真實物理世界中穩定完成任務的能力,此為Physical AI發展的關鍵。論壇聚焦通用物理智慧的技術演進與產業路徑,匯聚眾多專家參與。

阿里巴巴達摩院推出肝癌 AI 模型:可精準識別 1 釐米微小腫瘤
作者:遠洋 責編:遠洋 評論: 感謝網友 HH_KK 的線索投遞!8 月 24 日消息,阿里巴巴達摩院聯合中國醫科大學附屬盛京醫院等機構研發出肝癌診斷 AI 模型 DAMO LiON,可通過 CT 影像識別微小的肝臟癌變病灶。在兩個月的真實世界前瞻臨床試驗中,該 AI 模型發現了 15 例原本被遺漏的惡性腫瘤,絕大部分為 1 釐米左右的病灶,幫助患者得到及時的手術或藥物治療。
數學自動形式化迎來重大突破:OpenBMB開源MathForm,8B模型憑實力逆襲大廠
OpenBMB團隊開源數學自動形式化框架、數據集與模型MathForm,目標是用Lean4讓機器準確讀懂並形式化驗證數學定理,攻克通用人工智能核心挑戰。其關鍵不是簡單翻譯自然語言,而是將每個數學概念精準映射到Mathlib庫中,為數學與AI交叉研究提供新工具。

加州伯克利數學教授撰文批評學生基礎差,卻被抓包“用 AI 寫的”
作者:清源 責編:清源 評論: 8 月 23 日消息,據英國《衛報》20 日報道,加州大學伯克利分校數學教授茲韋茲德利娜 · 斯坦科娃日前在《舊金山標準報》撰文批評部分學生存在“嚴重”的數學基礎缺失,卻又承認文章本身曾藉助 AI 編輯,由此引發爭議。

美國專家示警:學生依賴“AI 代寫”會削弱思考能力
作者:清源 責編:清源 評論: 8 月 23 日消息,美國學生使用 AI 完成作業、甚至代寫整篇論文的現象已經十分普遍,也有不少學校允許學生在一定範圍內藉助 AI 工具。據《紐約時報》當地時間 17 日報道,越來越多專家擔心,問題可能不只是學生會不會寫文章,而是長期依賴 AI 可能削弱他們本身的思考能力。