Claude“腦內小劇場”首曝光:隱藏工作空間自發湧現類人意識,谷歌DeepMind權威認證

2026年7月7日 17:30
Claude“腦內小劇場”首曝光:隱藏工作空間自發湧現類人意識,谷歌DeepMind權威認證

重點摘要

Anthropic 研究發現其 Claude 語言模型在訓練中自發形成一個小型「工作空間」,用於存放和處理想法,且內部結構與人類意識處理方式高度相似。這項發現已開始影響 Anthropic 監測 AI 安全風險的方式,相關代碼已開源,並與神經科學家合作推出互動式演示。

站內 AI 整理稿

Claude“腦內小劇場”首曝光:隱藏工作空間自發湧現類人意識,谷歌DeepMind權威認證AI前線·2026年07月07日 17:18近日,Anthropic 發佈了一篇重磅研究論文,指出其 Claude 語言模型在訓練過程中自 近日,Anthropic 發佈了一篇重磅研究論文,指出其 Claude 語言模型在訓練過程中自發形成了一個小型“工作空間”,模型會在其中存放和處理想法,而無需將其表達為語言輸出。關鍵的是,其內部結構竟然與人類有意識地獲取和處理思想的方式高度相似。該公司表示,這一發現已經開始重塑其監測 AI 系統安全風險的方式。

在關於機器是否可能具備某種“心智”的科學爭論愈發激烈的背景下,這一研究尤為引人關注。現在,Anthropic 已開源相關代碼,並與 Neuronpedia 合作推出了交互式演示,同時邀請了參與“全局神經工作空間模型”研究的神經科學家 Stanislas Dehaene 和 Lionel Naccache,以及 Eleos AI Research 和 Rethink Priorities 的 AI 福利研究人員參與評議。開源倉庫:https://github.com/anthropics/jacobian-lens 演示鏈接:http://neuronpedia.

org/jlens 新視角:AI“未說出口”的那些想法 這項由 16 位作者共同完成的研究,題為《可言說表徵在語言模型中形成全局工作空間》(Verbalizable Representations Form a Global Workspace in Language Models)。

論文描述,Anthropic 研究人員通過一種全新的數學方法深入探查 Claude 的神經網絡,發現了他們稱之為“J 空間”(J-space)的結構,這是一個規模較小但“特權化”的內部活動區域,模型在其中存儲可以被報告、推理並主動調用的概念;其周圍則是一個龐大的自動化處理“海洋”,這些過程模型既無法直接訪問,也無法表達。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

剛剛
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

11 分鐘前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

12 分鐘前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

16 分鐘前