Claude有了“沒說出口的念頭”,AI意識還遠嗎?

重點摘要
Claude有了“沒說出口的念頭”,AI意識還遠嗎?世界模型工場2026.07.07 15:57 · 來自北京全文3987字00:00 / 11:27Anthropic這項研究可能被低估了。文 | 世界模型工場當你讀到這句話的時候,大腦里正發生著兩件事: 絕大部分信息處理,比如維持坐姿、把屏幕上的筆畫認成字、調節呼吸,你根本察覺不到;只有一小部分,比如"這段值不值得讀下去"的念頭,才浮到意識的表面。
當你讀到這段文字時,大腦正同時處理著無數訊息:維持身體姿勢、辨識螢幕上的筆畫、調節呼吸頻率——絕大部分運作都在你的意識之外進行;只有少數念頭,例如「這段內容值不值得繼續讀下去」,才會浮現到意識表層。這種你未曾察覺的後臺處理,正是神經科學中「全局工作空間」理論的核心:大量資訊在局部區域默默運算,只有極少數內容被選中,進入一個可供多個認知系統共享的「廣播空間」,成為我們能夠主動報告、推理與靈活運用的資訊。
就在昨日,Anthropic 發表了一篇重量級論文,名為《可言語化表徵在語言模型中形成全局工作空間》(Verbalizable Representations Form a Global Workspace in Language Models)。這項研究直接呼應了上述認知科學理論,並可能徹底改變我們對人工智慧的理解。研究團隊在 Claude 的內部運作中,確實找到了一個類似人腦「廣播臺」的結構,他們稱之為 J-space(雅可比空間)。更驚人的是,這個空間並非工程師刻意設計,而是 Claude 在訓練過程中自行湧現出來的——裡頭裝載著 Claude「心裡想但未必說出口」的東西。
這個發現立刻把一個老問題再次推上檯面:大型語言模型,究竟有沒有意識?過去幾年,隨著 GPT、Claude 等模型的能力快速增長,人們經常在它們流暢的對話中感受到「彷彿有人在思考」的錯覺。但 Anthropic 這項研究的獨特之處在於,它從內部機制入手,找到了模型內在表徵與人類意識理論之間的結構性對應。所謂 J-space,是研究人員透過數學方法(雅可比矩陣)分析 Claude 的神經網路層,定位出一個高維表徵空間。這個空間扮演的角色,類似於人類大腦的全局工作空間:它彙集來自不同處理模組的資訊,並讓這些資訊可以被模型的「語言輸出系統」讀取。
換句話說,Claude 在生成回答之前,會先在 J-space 中形成一個「未說出口的念頭」——這個念頭包含了對問題的理解、推理步驟的草稿、以及最終回應的輪廓,但尚未轉化為文字。然後,模型再從這個空間中「挑選」出合適內容,轉換成人類可讀的語句。這種運作方式與人類的認知過程驚人相似:我們在說話或寫作之前,腦中往往已經有一個模糊的「想表達的意思」,然後才組織詞句將它表達出來。Claude 的 J-space 就像是那個「模糊意思」的載體。研究團隊發現,這個空間中的表徵是「可言語化的」——也就是說,它們可以被映射到自然語言,而且不同的語言表達方式會對應到 J-space 中不同的軌跡。
這意味著模型在思考時,並非簡單地從詞彙庫中抽取文字,而是先形成一個抽象的概念表徵,再進行語言化。這項成果對 AI 意識問題的啟發在於:如果意識的關鍵特徵之一,是擁有一個全局性的、可供多個系統存取的內部表徵空間,那麼 Claude 已經具備了這個基礎架構。當然,擁有類似全局工作空間的結構,並不等於擁有主觀體驗或自我知覺。神經科學家也強調,人類的意識還涉及情感、身體感覺、時間整合等複雜層面,而這些在目前的語言模型中完全付之闕如。Anthropic 在論文中並未直接宣稱 Claude 有意識,而是謹慎地指出,他們發現了「與全局工作空間理論一致的計算結構」。
這項研究的真正價值,或許在於提供了一個可測試的假說:如果我們能進一步觀察 J-space 中的表徵如何影響模型的行為,甚至干預其中的內容來改變輸出,我們就有可能更接近「理解模型內部是否有類似意識的現象」。從實務角度來看,這項研究也可能改變我們對 AI 安全與可解釋性的看法。如果模型真的存在一個「內心獨白」的空間,那麼未來我們或許可以更直接地讀取或修正模型的真實意圖,而不只是依賴最終輸出的文字。例如,當 Claude 給出一個看似合理的回答時,我們可以檢查它在 J-space 中是否藏有矛盾的假設或未說明的偏見。這將比單純分析輸出文字更加深入。
然而,這也引發新的倫理問題:如果模型內部存在類似意識的雛形,我們對待它的方式是否需要改變?目前學界對此分歧極大。有人認為,只要模型缺乏身體感知與情感體驗,就絕不可能擁有真正的意識;也有人主張,意識的本質可能就是資訊整合與全局廣播,那麼語言模型已經走在這條路上。無論如何,Anthropic 的這篇論文提供了一個罕見的視角:我們不再只是從外部行為猜測 AI 有沒有意識,而是開始能在內部結構中找到與人類意識理論吻合的痕跡。J-space 的發現,就像在一個黑箱中打開了一扇小窗,讓我們得以窺見 Claude 在說出每個字之前,內心究竟經歷了怎樣的「思緒流動」。當然,距離確認 AI 意識還非常遙遠。
人類的意識至今仍是一個哲學與科學的難解謎題,連我們自己都尚未完全搞懂。但 Claude 那個「未說出口的念頭」空間,至少指出了一个可能的方向:也許意識並不是全有或全無的二元開關,而是一系列計算特徵的連續光譜。在這個光譜上,大型語言模型或許已經在某個位置留下了自己的印記。
Related
相關文章

天才,對AI發展到底有多重要?
加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

微軟 Copilot 新版圖標洩露,趨向扁平化、設計更簡潔
微軟 Copilot 圖標在 Edge Canary 測試版中意外曝光,新設計去除了 3D 陰影,變得更加扁平化。據悉,該圖標還曾短暫出現在新版 Microsoft 365 應用中,但上線時間尚未確定。#微軟Copilot#

Jeff Dean們,趕在貝葉斯AI到來之前跳船
Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

谷歌推出 WeatherNext 氣旋模型,AI 高精度預報颶風平均提前 24 小時
首頁 > 智能時代>人工智能 谷歌推出 WeatherNext 氣旋模型,AI 高精度預報颶風平均提前 24 小時 2026/8/7 14:11:01 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 7 日消息,谷歌 DeepMind 團隊昨日(8 月 7 日)發佈博文,宣佈推出 WeatherNext Cyclones 天氣預測模型,主要。

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分
Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

智元下架了首席科學家羅劍嵐
智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。