何夕2077研究與前沿

科學家成功重釋世界模型

2026年7月17日 00:00

重點摘要

科學家成功重釋世界模型 人工智慧領域長期以來追尋能像人類一樣推測未來、理解因果關係的「世界模型」,其中聯合嵌入預測架構(JEPA)被視為實現潛在世界模型的主流技術路線。然而,JEPA 的訓練目標大多依靠實驗表現來調整,缺乏統一的理論基礎。近日,一支研究團隊在預印本平台 arXiv 發表論文,從活性推論(Active Inference)的角度為 JEPA 世界模型提供了嚴謹的變分自由能解釋,並指出一項名為 SIGReg 的正則化機制能讓模型趨近理論最佳解。

站內 AI 整理稿

科學家成功重釋世界模型

人工智慧領域長期以來追尋能像人類一樣推測未來、理解因果關係的「世界模型」,其中聯合嵌入預測架構(JEPA)被視為實現潛在世界模型的主流技術路線。然而,JEPA 的訓練目標大多依靠實驗表現來調整,缺乏統一的理論基礎。近日,一支研究團隊在預印本平台 arXiv 發表論文,從活性推論(Active Inference)的角度為 JEPA 世界模型提供了嚴謹的變分自由能解釋,並指出一項名為 SIGReg 的正則化機制能讓模型趨近理論最佳解。

研究人員 Fabio Arnez 與 Alexandra Gomez-Villa 在論文中指出,JEPA 的訓練目標由預測損失加上加權的嵌入正則化項組成,這個目標是否能視為活性推論框架下的變分自由能,關鍵在於反坍縮正則化器的選擇。活性推論是認知科學與計算神經科學中的重要理論,主張智慧系統透過最小化「自由能」來感知與行動,而 JEPA 世界模型一直被認為與此概念有潛在聯繫,卻未曾被嚴格證明。

團隊系統性地比較了四種非對比式正則化器:VICReg、LogDet、PairDist 與 SIGReg,並將它們組織成一個按照先驗校準差距(prior-miscalibration gap)排序的熵估計器層級。這個差距的符號——究竟是對潛在熵給出上界還是下界——決定了活性推論中的 surprise bound 能否被保留。結果顯示,VICReg 與 LogDet 屬於不安全的上界估計,PairDist 則是安全的下界,唯有 SIGReg 能徹底消除差距,使目標函數與活性推論自由能完全對應。

進一步的對應定理證明,在標準常數噪聲編碼器模型且 SIGReg 成功運作(即產生等向性高斯嵌入)的條件下,先驗校準差距消失,訓練目標轉變為精確的資訊瓶頸(information bottleneck)。此時 surprise bound 被完整保留,而潛在目標成本(latent goal cost)成為活性推論中實用價值(pragmatic value)的精確代理。相較之下,若使用 VICReg 則會留下無法消除的二階各向異性項,破壞理論對應。

研究團隊還將這套對應關係擴展至多步期望自由能、集成認知價值(ensemble epistemic value)以及學習策略機制,並明確指出當前所有 JEPA 世界模型都缺少一項活性推論中的關鍵成分:狀態認知價值(state-epistemic value),這是一種未來狀態覆蓋信號,對探索與資訊蒐集至關重要。這篇論文共 28 頁,包含 4 張圖表,於 2026 年 7 月 15 日提交。作者強調這是一篇純理論研究,所有預測的差異屬於種類層級而非程度差異,相關的實證驗證將留待後續獨立工作進行。不過,論文中的核心代數結果已透過 Lean 4 定理證明器完成機械驗證,為理論奠定了堅實基礎。

這項成果不僅為 JEPA 世界模型提供了缺失的理論支柱,也為後續設計更接近生物認知的 AI 架構指出了明確方向。未來研究者可依據 SIGReg 的理論優勢開發更穩健的世界模型,並補上狀態認知價值這塊拼圖,讓人工智慧真正學會主動推測未知情境,而不僅是被動預測已知模式。

Related

相關文章

天才,對AI發展到底有多重要?

加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

剛剛

Jeff Dean們,趕在貝葉斯AI到來之前跳船

Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

4 小時前

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分

Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

6 小時前

智元下架了首席科學家羅劍嵐

智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。

10 小時前