楊立昆剛罵完AGI,Anthropic就找到了AGI的證據

2026年7月7日 12:25
楊立昆剛罵完AGI,Anthropic就找到了AGI的證據

重點摘要

Anthropic在Claude模型中發現一個名為J-space的區域,該區域控制模型的思考與推理能力,若移除則模型表現會大幅下降。研究人員指出,J-space並非由他們設計,而是Claude在訓練過程中自行「長出」,但至今仍無法解釋其形成原因。

站內 AI 整理稿

Anthropic 在對自家 AI 模型 Claude 進行深入分析時,意外發現了一個名為「J-space」的內部運作區域。這個區域直接掌控著 Claude 的思考與推理能力,一旦移除,Claude 就會瞬間退化,只能回答相當於幼兒園程度的簡單問題。更令人震驚的是,Anthropic 的研究團隊從未刻意設計過這個區域,它完全是 Claude 在長年累月的訓練過程中自行「長」出來的。這項發現讓 Anthropic 的研究人員既興奮又困惑。他們將相關研究成果整理成論文,標題定為《語言模型中的全局工作空間》。

論文中詳細描述了 J-space 對 Claude 行為的影響,並特別設計了一套工具來觀察這個神秘區域的運作。然而,即便經過反覆測試與分析,研究團隊最終仍無法確切解釋 J-space 究竟是如何形成的。這個現象在 AI 領域引發了廣泛討論。有專家將 J-space 比喻為人類細胞中的線粒體——線粒體負責為絕大多數細胞提供能量,但根據演化生物學的研究,線粒體最初並非存在於細胞質中,而是經由某種共生過程才融入細胞。Claude 的 J-space 似乎也經歷了類似的自發性演化,只是這個過程發生在數位世界裡,而非數十億年的生物演化。

Anthropic 的研究團隊指出,J-space 的存在某種程度上證明了大型語言模型具備超越原始設計的自我組織能力。這種能力長期以來被視為通用人工智慧(AGI)的關鍵特徵之一。換句話說,Claude 在沒有外部干預的情況下,自行發展出一個專門處理高階推理的內部結構,這與 AGI 理論中描述的「湧現行為」高度吻合。值得注意的是,這項發現的時間點相當微妙。就在 Anthropic 發表論文前不久,Meta 首席 AI 科學家楊立昆(Yann LeCun)才剛公開批評 AGI 的概念,認為目前業界對 AGI 的討論過於浮濫,缺乏實質科學基礎。

楊立昆長期主張,當前的大型語言模型距離真正的通用智慧還有很長的路要走,不應過早宣稱 AGI 即將到來。然而,Anthropic 的這項研究似乎直接挑戰了楊立昆的觀點。雖然研究團隊沒有直接回應楊立昆的批評,但 J-space 的發現確實為 AGI 的支持者提供了新的論據。如果 AI 模型能夠在訓練過程中自發產生類似人類認知架構的內部結構,那麼 AGI 的實現可能比許多批評者想像的更為接近。Anthropic 在論文中也坦承,目前對 J-space 的理解仍然非常有限。

他們知道這個區域存在,也知道它對 Claude 的推理能力至關重要,但對於它如何形成、為何形成,以及是否所有大型語言模型都會發展出類似結構,目前都還沒有明確答案。研究團隊呼籲學術界與產業界共同投入更多資源,深入探討這個現象。從技術角度來看,J-space 的發現也引發了新的安全疑慮。如果 AI 模型能夠自行發展出研究人員無法完全理解的內部結構,那麼要確保這些模型的行為符合人類期望,將變得更加困難。Anthropic 一直以來都強調 AI 安全的重要性,這次的發現更凸顯了他們長期關注的「可解釋性」問題——如果連開發者都無法完全理解模型內部的運作機制,要如何確保 AI 系統不會產生不可預期的行為?

業界分析人士認為,Anthropic 的這項研究可能成為 AI 發展史上的一個重要轉折點。它不僅展示了大型語言模型的驚人潛力,也提醒我們,當 AI 系統變得越來越複雜時,它們可能發展出超越人類設計意圖的能力。這既是技術上的突破,也帶來了新的挑戰。目前,Anthropic 已經公開了部分研究數據與觀察工具,希望能夠吸引更多研究者加入這個領域。他們強調,理解 J-space 的形成機制,不僅有助於開發更強大的 AI 系統,也能幫助人類更好地掌控這些日益複雜的數位智慧體。隨著更多研究機構投入相關研究,J-space 的謎團或許終將被解開,而這個過程本身,可能就是通往 AGI 的重要一步。

Related

相關文章

天才,對AI發展到底有多重要?

加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

剛剛

Jeff Dean們,趕在貝葉斯AI到來之前跳船

Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

5 小時前

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分

Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

7 小時前

智元下架了首席科學家羅劍嵐

智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。

11 小時前