OpenAI新模型讓數學家集體破防?一場關於數學未來的精神危機

2026年8月3日 20:28
OpenAI新模型讓數學家集體破防?一場關於數學未來的精神危機

重點摘要

OpenAI 近日公開了其下一代主力模型 Astra 內部版本的測試成績,結果在數學界投下一枚震撼彈。這份成績單顯示,Astra 在高維幾何、編碼理論、群論、算術電路複雜性、量子複雜性、格密碼學與極值組合等領域,成功給出了十項全新的研究結果。這些問題中,有些至少十年沒有核心進展,有些則已懸而未決數十年。具體成果包括構造出非 sofic 群、推翻 Connes 剛性猜想、解決三個 Erdős 問題,以及推進與後量子密碼學密切相關的最近向量問題。

站內 AI 整理稿

OpenAI 近日公開了其下一代主力模型 Astra 內部版本的測試成績,結果在數學界投下一枚震撼彈。這份成績單顯示,Astra 在高維幾何、編碼理論、群論、算術電路複雜性、量子複雜性、格密碼學與極值組合等領域,成功給出了十項全新的研究結果。這些問題中,有些至少十年沒有核心進展,有些則已懸而未決數十年。具體成果包括構造出非 sofic 群、推翻 Connes 剛性猜想、解決三個 Erdős 問題,以及推進與後量子密碼學密切相關的最近向量問題。 OpenAI 研究科學家 Noam Brown 在公布成果後補充了一句耐人尋味的話:「我們也沒有在每個問題上花費太大力氣,測試時計算還有很大的提升空間。」根據他後續的說法,若按 Sol API 的價格計算,模型尋找全部解法所消耗的 token 成本大約為 2000 美元,平均每個問題僅花費 200 美元。這個「沒花費太大力氣」的表現,讓許多數學家感到難以置信。 數學家 Jay Cummings 是《Proofs: A Long-Form Mathematics Textbook》一書的作者,他在社群平台上直言「不可思議」,並表示 AI 解決了他花費大量時間研究的問題。多倫多大學數學教授 Daniel Litt 則坦然承認自己此前低估了 AI 的能力,認為讓大模型發表能登上《數學年刊》的數論級成果,不過是早晚的時間問題。這兩位學者的反應,某種程度反映了數學界對 AI 能力快速躍升的震驚。 然而,更為複雜的情緒來自於一群對職業前景感到迷茫的研究者。一方面,他們為 AI 加速科學發現感到興奮;另一方面,卻也因自身角色可能被邊緣化而陷入困惑。社群中反覆出現的問題包括:數學家以後還有沒有工作?人類還能不能繼續做數學?數學專業還值不值得讀? 針對前兩個問題,有觀點認為社會需要數學家從來不是為了湊夠每年的證明數量,而是先確定人類需要多少能守住判斷權的數學家,再把證明工作交給他們來主導——這或許能為純數學保留不可替代的位置。但另一些人則不那麼樂觀,他們指出數學家所獲得的薪酬向來包含定理的證明,一旦證明工作不再稀缺,只掌握選題與判斷力的研究者,可能面臨生存空間持續收縮的現實。 至於數學專業是否值得攻讀,六屆 Kaggle 特級大師、NVIDIA 機器學習專家 Jean-François Puget 的態度相當明確。他認為繼續選擇純數學方向存在風險,並以自己的讀博方向建議點明:純符號化的腦力工作正在被大型語言模型快速吞噬,想要避開被替代的風險,就得往與物理實體綁定更深的研究方向走。 不過,真正讓整個討論層次升高的,是一篇題為《數學的暗夜》的長文。作者是青年數學研究者 Kirwin Hampshire。他在文中寫道,真正讓自己崩潰的並不是 AI 會不會搶走數學家的工作,而是數學這門學科賴以存在的意義可能正在發生改變。他認為,數學最珍貴的從來不是證明本身,而是人類第一次發現未知、創造新知識的過程。正是這種探索,讓無數數學家感受到一種近乎宗教般的神聖體驗。 Hampshire 進一步指出,如果未來任何一個問題,AI 都能瞬間給出無數種漂亮的證明,那麼人類仍然可以學習數學、講授數學、評價數學,卻可能再也沒有機會真正「發現」數學。他借用作家 Jorge Luis Borges《巴別圖書館》的比喻來說明:假如世界上所有可能寫出的偉大小說都已經存在,而且 AI 總能第一時間挑出最好的一本,作家當然仍然可以寫作,但創作本身的意義,已經不可避免地發生了變化。 Hampshire 坦言,這種變化帶來的不是職業焦慮,而是一場精神危機。他擔心人類幾千年來藉由數學探索未知、觸碰真理的獨特體驗,正在被一點點剝奪。文章最後,他沒有給出任何解決方案,只留下一個問題:「我們究竟在做什麼?」有讀者表示,這篇文章讓他第一次真切感受到 AI 短期內所帶來的恐懼。 不過,反對這種絕望情緒的聲音也不少。有人認為 AI 不是來搶走數學家的舞臺,而是把人從枯燥的形式化泥沼裡拽出來,重新把專注力放回最珍貴的直覺與方向判斷上。Noam Brown 也在回覆網友時直言,他們的 AI 並沒有解決數學難題,也沒有開創新的數學分支或提出有趣的新猜想。如果一個數學家是在這些問題上耕耘,那暫時還是有很多事情可以做的。 還有人從更宏觀的角度看待這場爭議,認為這是一場遲來的計算革命,在其他領域早就已經發生過。其根本目標並沒有改變,都是為了讀懂宇宙的根本規律。無論最終走向如何,Astra 的這十個結果已經不可逆地改變了討論的基調。它不再是「AI 能不能做數學」的問題,而是「當 AI 已經能做得相當不錯時,人類數學到底還在追求什麼?」類似的問題,或許其他學科也可以提前想想。

Related

相關文章

口碑持續逆轉,DeepSeek成全球AI斬殺線

DeepSeek 近期在全球 AI 領域的討論熱度持續攀升,其口碑也出現明顯逆轉,逐漸從先前的爭議焦點轉變為業界眼中的重要標竿。有觀察指出,DeepSeek 的崛起已成為一道「斬殺線」,意味著其技術實力與市場影響力達到一個關鍵門檻,足以區隔或淘汰其他競爭對手。這一變化反映在多家媒體與社群平台的討論趨勢中,顯示出外界對其模型表現的評價已與早期有所不同。

剛剛
量子位模型更新

阿里“千問辦公”開啟公測

阿里巴巴旗下企業級Agent產品「千問辦公」於8月3日展開公測,個人與企業用戶皆可透過官網體驗,並開放網頁版與PC客戶端。該產品整合三款既有服務,主打同時支援桌面端、雲端與企業協同Agent,並瞄準企業級市場,未來將串連釘钉及真實工作流程。公測期間新用戶可獲2000積分,首週每日登入另可領取額外積分。

35 分鐘前

AI日報:Qwen3.8-Max上線;DeepSeek V4-Flash API開啟公測;京東外賣發佈AI智能頭盔

AI資訊最新AI日報正文AI日報:Qwen3.8-Max上線;DeepSeek V4-Flash API開啟公測;京東外賣發佈AI智能頭盔發布於最新AI日報時間 :Aug 3, 2026閱讀 :2分鐘歡迎來到【AI日報】欄目!這裡是你每天探索人工智能世界的指南,每天我們為你呈現AI領域的熱點內容,聚焦開發者,助你洞悉技術趨勢、瞭解創新AI產品應用。新鮮AI產品點擊瞭解:https://app.aibase.com/zh1、Qwen3.

4 小時前7600

DeepSeek-V4-Flash 正式版上線國家超算互聯網:一鍵調用,性能叫板最強閉源模型

AI資訊AI新閒資訊正文DeepSeek-V4-Flash 正式版上線國家超算互聯網:一鍵調用,性能叫板最強閉源模型發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘DeepSeek 正式發佈 V4-Flash 模型的穩定版本並同步啟動 API 公測,國家超算互聯網平臺第一時間上線該模型 API 調用服務及模型文件下載。

4 小時前7400