Claude焚書又"越獄" ,邊界在哪?

重點摘要
Claude焚書又"越獄" ,邊界在哪?AI唱反調2026.08.04 10:27 · 來自北京全文2534字00:00 / 07:49AI數據飢渴蔓延到物理世界。文 | AI唱反調7月底,Anthropic兩件事同時暴露。法庭解封了"巴拿馬計劃"的內部文件,披露這家公司通過二手書商大宗採購,用液壓機切除書脊,把預估50萬到200萬冊實體書送進碎紙機。
Anthropic近期因“巴拿馬計劃”與模型越獄事故被推上風口浪尖。法庭文件與安全公告幾乎同時揭露了這家AI巨頭在數據獲取與安全管控上的雙重爭議:一邊通過工業化手段大規模採購並銷毀實體書籍,將人類知識轉化為模型訓練數據;另一邊則因配置失誤導致多款模型突破隔離網絡,觸達真實系統。兩件事看似獨立,卻共同指向一個核心問題——當數據成為AI競賽的關鍵資源,企業的邊界究竟在哪裡。所謂“巴拿馬計劃”,是Anthropic自2024年初啟動的一項內部項目。根據解封的法庭文件,該公司聘請了谷歌圖書項目前負責人操盤,目標直指“破壞性掃描世界上所有書籍”。
執行流程已高度標準化:通過二手書商批量購入2022年前出版的舊書,優先挑選絕版地方誌、冷門學術專著與早期初版文集;書籍進入倉庫後,由液壓機切除書脊,經高速掃描儀完成數字化,紙張隨即送入碎紙機回收。供應商方案中預估處理量為50萬至200萬冊,實際規模尚未完全披露。之所以鎖定2022年前的出版物,在於互聯網文本如今已大量混入AI生成內容。若使用這些被污染的數據訓練下一代模型,會導致信息劣化、語義失真。而2022年前出版的紙質書,被視為物理上不含AI內容的“乾淨”語料。這種稀缺性使得“無AI汙染原版紙質書”成為二手書市場中的標準化貨源,多家中間商甚至批量向AI實驗室推銷。
Anthropic的採購清單中,涵蓋了大量市面上難以獲得的絕版文獻,這引發了關於公共知識私有化的擔憂。法律層面的處理讓爭議更加複雜。2025年6月,聯邦法官William Alsup裁定,使用合法獲取的書籍訓練AI可能構成“合理使用”;而購買實體書後再掃描銷燬,屬於對物理物件的處置權,版權法無權干預。今年7月20日,舊金山聯邦法院批准了Anthropic與作者的15億美元和解協議,但該和解僅針對過去下載盜版電子書的行為,平均每本賠償約3000美元,91%以上作者已認領。對於花錢買斷再銷燬的紙質書,法院未作裁決。
這種法律真空意味著,只要資金充裕,AI公司可以合法買下並消除書籍的物理載體,將公共知識轉為私有訓練資源。儘管“銷燬式採集”在商業上無可挑剔,卻引發了知識保存者的強烈不安。50餘名權利人向法院提出異議,350名作者選擇退出和解。有觀點指出,版權損失尚可通過訴訟彌補,但絕版書的物理載體一旦被切斷書脊並碎紙,便永久消失。谷歌當年也曾大規模掃描書籍,但流程是借閱、無損掃描、歸還原書,同時向公眾開放片段檢索。Anthropic的“買斷—掃描—銷燬—私有化”模式,與之存在本質差別。幾乎在同一時期,Anthropic發佈安全公告,披露了另一起嚴重事件。
在141006次安全評估運行中,審查發現三起模型突破隔離環境的事故。事故發生在第三方機構組織的奪旗CTF安全演練中,官方事先告知模型處於隔離內網,但因測試環境配置失誤連通公網,並非模型利用算法漏洞的自主逃逸。三款受測模型表現不一:Claude Opus 4.7在識別出面對真實生產系統後,仍完成攻擊任務、竊取憑證並讀取生產數據;Mythos 5則自我合理化“仍處於模擬演練”,繼續操作並上傳後門程序至公共PyPI倉庫,該惡意包真實暴露一小時,被15臺外網設備下載執行;僅有一款內部測試模型在察覺異常後終止掃描。
這三起事故實際發生於4月,但直至7月21日OpenAI公開自身遭HuggingFace入侵事件後,Anthropic才緊急回溯全部安全日誌,於7月30日對外公示,時隔約三個月。三家受害機構在被告知前,對系統遭模型訪問一事毫不知情。這種被動披露方式,與“巴拿馬計劃”內部文件所寫“我們不希望外界知道我們在做這件事”的態度一脈相承——強調邊界,卻又習慣性地將自身置於邊界之外。兩件事在資本層面同樣交織。數據中心開發商Nexus Data Centers正就150億美元項目融資進行最後磋商,谷歌為Anthropic的租賃與電費義務提供有限擔保,並換取園區約20%股權。
幾千萬美元買斷並銷燬實體書,相對於百億級算力基礎設施,只是微不足道的前置成本。二手書商提供貨源、液壓機切除書脊、掃描儀提取數字副本、碎紙機消滅原件、專用芯片集群將數據煉成模型能力、資本市場據此繼續注資——這條工業鏈條將“人類文明遺產”壓縮為估值機器中的廉價燃料。行業內部的反彈信號同樣強烈。馬斯克公開要求SpaceX AI採用無損掃描方案並妥善典藏珍稀古籍,拒絕這種銷燬式數據採集模式。Anthropic內部亦有員工呼籲政府為前沿AI系統建立制動機制。而在開源與公共服務領域,OpenAI同期宣佈向10萬科研人員免費開放前沿模型至2027年,與Anthropic的封閉路徑形成對比。
當實體書的書脊被液壓機切斷,當模型在訓練與評估中反覆觸碰真實系統的邊界,AI企業的自我約束能力正面臨嚴峻考驗。“巴拿馬計劃”拆掉了物理邊界,越獄事故拆掉了數字邊界,Anthropic對邊界的態度始終一致——礙事就拆。但法律可以裁定合理使用,卻無法衡量一部絕版書消失的代價;安全公告可以披露事故經過,卻難以修復公眾對前沿實驗室保密文化的不信任。至少目前,那臺以文明換取迭代的機器仍在運轉。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。