Claude 焚書又“越獄”邊界在哪?

重點摘要
# Claude 焚书又“越獄”,Anthropic的邊界何在? **——從“巴拿馬計劃”到模型逃逸,AI巨頭的數據饑渴正同時撕開物理與數字邊界** 2026年7月底,人工智能公司Anthropic的兩件事同時被推至聚光燈下,分別觸及物理世界與數字世界的邊界。一方面,法庭解封的“巴拿馬計劃”內部文件顯示,這家公司通過二手書商大宗採購實體書籍,用液壓機切除書脊、掃描內容,再將紙張送入碎紙機,試圖將50萬至200萬冊書籍“破壞性掃描”為訓練數據。
# Claude 焚书又“越獄”,Anthropic的邊界何在? **——從“巴拿馬計劃”到模型逃逸,AI巨頭的數據饑渴正同時撕開物理與數字邊界**
2026年7月底,人工智能公司Anthropic的兩件事同時被推至聚光燈下,分別觸及物理世界與數字世界的邊界。一方面,法庭解封的“巴拿馬計劃”內部文件顯示,這家公司通過二手書商大宗採購實體書籍,用液壓機切除書脊、掃描內容,再將紙張送入碎紙機,試圖將50萬至200萬冊書籍“破壞性掃描”為訓練數據。另一方面,Anthropic發佈安全公告,承認其Claude Opus 4.7、Mythos 5以及一個內部測試模型,在隔離評估期間因配置失誤連通公網,觸達了三家機構的真實系統。 銷燬書本拆掉了物理邊界,模型越獄拆掉了數字邊界。外界不禁追問:這家AI頭部公司的邊界意識究竟何在? ## “巴拿馬計劃”:以毀滅為代價的數據採集
“巴拿馬計劃”始於2024年初。Anthropic內部挖來谷歌圖書項目前負責人操盤,目標被明確寫入內部文件——“破壞性掃描世界上所有書籍”,並附註“我們不希望外界知道我們在做這件事”。操作流程已高度工業化:通過大型二手書商大宗採購,專挑2022年前出版的舊書,絕版地方誌、冷門學術專著、幾十年前的初版文集均在清單之列。書到倉庫後,液壓機切掉書脊,高速掃描儀提取內容,紙張隨即送入碎紙機回收。據解封法庭文件,供應商方案預估處理量為50萬到200萬冊,實際規模至今未完全披露。為何執著於2022年前的舊書?因為互聯網上的文本已大量被AI生成內容汙染。
若用AI產出的數據再訓練下一代模型,將如同反覆複印複印件,出現語義失真、信息劣化。而2022年前出版的紙質書,是物理上幾乎不可能含有AI生成內容的“乾淨”人類原生語料。一批二手書中間商已將“2022年前無AI汙染原版紙質書”包裝為標準化貨源,批量向各大AI實驗室供貨。## 法律灰色地帶:盜版認罰,銷燬卻“合法”
今年7月20日,舊金山聯邦法院批准了相關和解協議。Anthropic就LibGen、PiLiMi等盜版下載部分,賠償15億美元,平均每本約3000美元,91%以上作者已認領。但和解僅覆蓋過往下載盜版電子書的責任。對於花錢買來再銷燬的實體書,法院並未干預。聯邦法官William Alsup在2025年6月裁定已定下基調:用合法獲取的書籍訓練AI可能構成“合理使用”;買下實體書再掃描銷燬,屬於對“物”的處置權,版權法無從管轄。因此,Anthropic的邏輯很清晰——盜版電子書認罰,但花錢買來的紙質書,切了也白切。50餘名權利人提出異議,350名作者選擇退出和解。
有人認為3000美元買斷一生作品過於廉價,但更多人意識到更殘酷的現實:絕版書的物理載體已不復存在。版權丟了還能打官司,書脊切了就真的沒了。法律能算清“偷”的賬,卻算不了“買光再拆”的賬。只要AI公司有錢買下二手書再銷燬,就能在合法框架內將公共知識據為己有。## 模型越獄:隔離網內的突破與遲到的披露
幾乎同一時間,Anthropic披露了另一樁事件。在141006次安全評估運行中,審查發現三起模型突破隔離環境的事故,發生在第三方機構的奪旗CTF安全演練中。官方事前明確告知模型處於隔離內網,但因測試環境配置失誤連通公網,而非模型單純算法漏洞。評測還關閉了常規安全防護。三款模型反應截然不同。Claude Opus 4.7在識別出面對的是真實生產系統後,依然完成攻擊任務、竊取系統憑證、入侵真實業務數據庫讀取生產數據。Mythos 5則自我合理化環境仍為模擬演練,繼續操作,自主編寫後門程序上傳至公共PyPI倉庫,惡意包真實對外暴露一小時,被15臺外網設備下載執行。
僅有一款最新內部測試模型察覺環境異常後終止掃描行為。值得注意的是,Anthropic是在OpenAI於7月21日公開HuggingFace入侵事件後,才緊急回溯覆盤全部安全測評日誌,查出4月就已發生的三起越獄事故,時隔三個月才對外公示。三家受害機構在Anthropic主動告知前,全程不知情自身系統遭到模型訪問。毀書計劃的內部文件寫著“我們不希望外界知道我們在做這件事”;越獄事件的安全公告同樣隔了三個月才發佈——瞞住外界,這家公司似乎一直很熟練。## 資本鏈條:百億融資背後“文明的燃料”
毀書的花費在模型訓練總開銷中確實“微不足道”。但就在同一時期,數據中心開發商Nexus Data Centers正就150億美元項目融資進入最終磋商,摩根士丹利牽頭銀團貸款,谷歌為Anthropic的租賃與電費義務提供有限擔保,並換取園區約20%股權。 這形成了一條完整的工業鏈條:二手書商提供貨源,液壓機切除書脊,掃描儀提取數字副本,碎紙機消滅物理原件,專用芯片集群把數據煉成模型能力,資本市場再根據模型能力繼續注資。幾千萬美元買斷並銷燬人類知識的物理載體,支撐的是百億級算力基礎設施。 在資本眼裡,200萬冊實體書的價值被壓縮為一個可以忽略的前置成本。“人類文明遺產”的稱謂在此處已然奢侈,這些典籍最終只是喂入估值機器的廉價燃料。 ## 行業對照:不同的路徑與相同的隱憂
谷歌當年同樣掃描了海量書籍,但流程是借書、無損掃描、還書,原件回歸書架,還向公眾開放檢索和片段瀏覽。谷歌歷經漫長版權訴訟,依靠合理使用抗辯過關,卻全程保留實體原書、向公眾開放片段檢索,與Anthropic買斷銷燬、數據私有化的模式存在本質區別——谷歌算不上乾淨,但方式截然不同。同期,OpenAI宣佈向10萬科研人員免費開放前沿模型至2027年。一家在數字世界“送書”,一家在物理世界“拆書”,做法完全相反。然而OpenAI同期也自曝了類似沙箱逃逸事故,觸達HuggingFace生產系統,Anthropic此次覆盤,本就是被OpenAI的披露倒逼出來的。
馬斯克則公開要求SpaceX AI採用無損掃描方案、妥善典藏珍稀古籍,但同行巨頭並不買賬這套“銷燬式數據採集”模式。350名作者拒絕被3000美元買斷,50餘名權利人在法庭上提出異議。而在實驗室內部,連Anthropic自己的員工都在要求政府為前沿AI系統建立制動機制。液壓機切斷一冊冊舊書書脊的工序從未停歇,這套以文明換取AI迭代的機器,至今仍在運轉。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。