OpenAI新模型攻克100多道數學難題,9位頂尖數學家組成顧問團

2026年9月21日 23:30
站內 AI 整理稿

編譯 | 楊京麗 編輯 | 李水青 9月22日消息,今天凌晨,OpenAI宣佈成立一個新的獨立顧問小組——數學與人工智能顧問小組,該小組設於美國新澤西州普林斯頓高等研究院。OpenAI於8月28日開始訓練一個新的內部模型。OpenAI稱,除了解決納維-斯托克斯方程千禧年大獎難題之外,該模型目前還解決了數學領域大多數分支中100多道長期懸而未決的開放問題。9月12日,25位菲爾茲獎得主聯合簽署公開信,抨擊AI公司將“解決著名數學難題”當作衡量模型能力的基準,是“對數學這門科學和數學共同體的傷害”。OpenAI稱,這些批評凸顯出,AI公司需要與數學界進行審慎、深入的溝通。

為此,OpenAI正在與一些數學家合作,成立了一個獨立的數學顧問小組。該小組將發揮溝通數學界與公眾的橋樑作用,讓數學家參與討論OpenAI未來的研究方向。OpenAI新成立的小組主要承擔顧問角色,包括評估新研究成果的重要性,並協調這些成果的發佈。儘管成員不會獲得報酬,但他們可以主動提出未經OpenAI徵求的建議、公開發表自己的觀點,並自行決定小組的成員構成。這使得該小組在一定程度上保持了對OpenAI的獨立性。需要特別說明的是,OpenAI稱,該小組不負責就OpenAI內部數學研究的推進速度提供建議。普林斯頓高等研究院稱:“雖然我們會提供建議,但我們在任何一家AI公司都不擁有決策權。

任何公司所作決定的責任,都將由該公司自行承擔。” 目前,共有9位知名數學家成為該小組的首批成員,其中來自普林斯頓高等研究院的Camillo De Lellis也簽署了那封由菲爾茲獎得主發起的公開信。結語:AI加速攻克數學難題,成果如何發佈成新問題 隨著AI加速攻克長期懸而未決的數學問題,業界關注的焦點已從“AI能否解題”轉向“研究成果應如何評估、發佈,以及由誰承擔責任”。成立獨立顧問小組,是OpenAI回應數學界擔憂的一步,但該小組既沒有決策權,也無法干預OpenAI內部數學研究的推進節奏,其能否真正發揮溝通和監督作用,仍有待觀察。

Related

相關文章

阿里雲發佈Qwen Book:AI智能體電腦正式亮相

產品搭載Skill鍵盤陣列、全局AI按鍵、語音手寫筆等交互入口,並提供支持7×24小時運行重度任務的操作空間,針對傳統AI辦公中跨應用、跨Agent協同效率不足的問題進行優化。Qwen Book基於“OS as Harness”理念,以千問端雲模型為核心,深度融合操作系統、應用、雲服務與硬件能力,統一管理交互入口、運行時環境、個人持續上下文以及軟硬件操控能力,構建可理解、可記憶、可持續運行和可治理的Agent計算環境。

剛剛

AI會自己返工到達標為止?豆包工作上線目標模式,先給計劃、確認後才幹活

目標模式面向有明確要求的複雜任務:用戶寫清楚驗收目標後開啟執行,豆包工作在完成任務後會對目標逐項校驗,只要有一項不達標,就自動返工、繼續調整,直到達標。計劃模式則面向步驟多、消耗大的複雜任務:豆包工作會先產出一份可審閱、可編輯的Markdown格式實施計劃,供用戶校準修改,待對齊工作需求並確認後才開啟執行,使執行過程更可控、資源與時間消耗更合理。

剛剛
雷峰網模型更新

啟仔遠仔,想成為第一個被你帶回家的硅基夥伴

啟元 T1,兩款機器人當天開售,基礎版本售價 19999 元。這是整個行業第一次有人把量產消費級人形機器人推進市場,且發售即發貨,10 月 1 日啟元就將按訂單陸續發貨。01Q1與T1,同一個問題的兩種回答啟元這次發佈的兩款機器人,一個叫 Q1(暱稱“啟仔”、“Q仔”),一個叫 T1(暱稱“遠仔”)。

剛剛
量子位模型更新

刷視頻也能教會機器人幹活!1200億tokens人類動作預訓練,誤差按冪律下降

個陌生家庭。它要收拾散落在客廳裡的玩具、疊毛巾、鋪床。機器人到達現場後,不再採集新數據,不更新模型權重,也不根據現場執行結果重新選擇模型。 視頻很容易被概括成“人形機器人‘零樣本’做家務”。嚴格來說卻並非如此。三個任務此前都在其他環境中用專門數據做過適配。

剛剛