世界模型的下一步?牛津、NUS團隊提出「心智世界建模」MWM:遠不止物理世界

重點摘要
這篇消息聚焦「世界模型的下一步?牛津、NUS團隊提出「心智世界建模」MWM:遠不止物理世界」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。
牛津大學與新加坡國立大學(NUS)的研究團隊近期提出「心智世界建模」(Mental World Model,簡稱MWM)的技術概念,將世界模型的定義從單純的物理環境模擬,延伸到認知與心理層面的理解。
這項研究被視為人工智慧在「理解世界」方向上的重要演進,不再只處理物體運動、空間關係等外在物理規則,而是試圖讓模型具備推測他人意圖、情緒與信念的能力,從而實現更接近人類互動的判斷與決策。
MWM的核心在於將「心智狀態」納入模型建構的變數。
傳統的世界模型通常以物理定律與可觀測事件為基礎,用來預測物體下一步的位置或狀態變化;而MWM則進一步內化「他者視角」,讓機器能夠根據行為與情境,推演對方可能擁有的知識、誤解或目標。
研究團隊指出,這種建模方式對自動駕駛、人機協作、社交機器人等領域尤為關鍵,因為這些場景大量涉及對人類行為動機的推測,而非僅是物理碰撞的預測。
目前這項研究仍處於理論與初步實驗階段,團隊以簡化情境測試MWM在「推測錯誤信念」上的表現,例如模擬一個人看到物體被移動前後的反應差異。
結果顯示,具備心智世界建模能力的系統,在預測他人下一步行動的準確度上,明顯優於僅依賴物理世界模型的傳統方法。
這也為後續開發更符合人類認知邏輯的通用人工智慧,提供了新的架構方向。
Related
相關文章

人形機器人做手術上《Nature》,臨床成熟度拿了2.5分
人形機器人成功完成手術任務,相關成果登上《Nature》,並首次獲得臨床成熟度評分2.5分。該分數代表技術已完成概念驗證與初步可行性測試,但距離大規模臨床應用仍有一段距離。專家指出,要真正參與臨床手術,仍需克服精密控制、即時反饋與人機協作等挑戰。

數學家24小時駁回OpenAI攻破的猜想!“AI證對了每句話,但已跟原猜想無關”
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 數學家24小時駁回OpenAI攻破的猜想!

AI 輔助“推翻”考拉茲猜想失敗,Lean 4.32.2 修復內核漏洞
一項藉助AI輔助、聲稱推翻考拉茲猜想的Lean形式化證明被確認無效,原因是Lean內核存在漏洞,導致系統能無條件接受假命題。Lean團隊在收到報告後迅速發布4.32.2版本修復該漏洞,該漏洞涉及內核處理嵌套歸納類型時忽略幽靈類型參數的檢查。

微軟測試其首款自研全雙工 AI 語音 MAI Realtime 模型:支持中文等 16 種語言、2 種風格
微軟正在測試其首款全雙工 AI 語音模型 MAI Realtime,支援中文等 16 種語言與兩種語音風格,可實現同步聆聽與回應。該模型目前僅開放給部分合作夥伴在 MAI Playground 進行測試,正式上線時間尚未公布。
臨床早診預測基準發佈
臨床早診預測基準發佈。 新的早診基準EarlyDx⚕️近期問世。它包含了大量來自急診記錄的真實數據。詳情可查閱急診室早診預測基準論文。現有大模型表現⊙.⊙仍遠遜於臨床醫生。
迭代檢索超越理想證據
迭代檢索超越理想證據。 研究者在多跳問答���中測試了多款模型。發現迭代檢索能帶來更顯著的性能提升。詳見多跳問答迭代檢索對比論文的內容。分段檢索能有效(≧▽≦)降低後續推理失誤。