Anthropic被罰15億美元,給全球數據“白嫖”敲響警鐘

重點摘要
美國法院批准作家對Anthropic的集體訴訟和解,Anthropic因非法囤積盜版訓練數據被判賠15億美元,此判決釐清AI訓練數據的合理使用紅線,也為全球AI數據合規與版權保護敲響警鐘。
美國加州北區聯邦法院近日正式批准作家群體對人工智慧公司Anthropic提出的集體訴訟和解方案,這場纏訟兩年的版權爭議最終以15億美元的天價和解金畫下句點。然而,真正撼動整個AI產業的並非賠償金額本身,而是法院判決背後所確立的關鍵法律邏輯:AI僅抓取訓練資料但不留存副本,與批量爬取並永久囤積素材,這兩種行為從此被切割為兩個完全獨立的法律問題——合法閱讀抓取可以免責,非法獲取囤積則必須重罰。這項判決直接點出了全球科技公司、版權方與監管機構最需要釐清的「合理使用」紅線。AI要持續進化,創作者要維持生計,兩者之間究竟有沒有第三條路?隨著Anthropic的和解,這個問題變得更加迫切。
15億美元的和解金,核心賠償標的是「盜版儲存」這項侵權行為。2025年6月23日,主審法官William Alsup在一份簡易判決中提出關鍵意見,將AI數據抓取行為明確劃分為兩種性質:一種是合規行為,即透過官方管道購買正版書籍,僅用於訓練模型語言能力,過程中不複製、不留存底本,這被視為「合理使用」;另一種則是侵權行為,即批量爬取盜版資源,並永久存檔海量圖書,建立數字倉庫囤積。法官明確指出,後者不能用「合理使用」作為擋箭牌。即使Anthropic囤積盜版書籍的初衷是訓練模型,但這些盜版副本的存在本身已構成對正版市場的潛在威脅,可能導致讀者減少購買正版書籍,進而蠶食作家的版稅與出版社的營收。
因此,15億美元和解金實質上是對Anthropic過去非法獲取與囤積盜版數據行為的懲罰。前科幻雜誌編輯、科幻小說創作者魏先生對時代財經表示,這項判決為AI訓練數據的法律邊界提供了重要參考。他指出,創作者公開作品本是促進思想交流的自願行為,但並不意味著其權利可以被忽視。無論是實體或電子形式,作品一旦公開,就附帶了創作者設定的規則。如果AI未經許可進行抓取,確實侵犯了作者的權利。儘管現行法律對此界定尚存模糊地帶,此次判決至少推動了相關法律邊界的清晰化,為保護創作者權益邁出關鍵一步。然而,15億美元的和解並不代表Anthropic從此高枕無憂。
法院對Anthropic設下了三條不可逾越的紅線:永久關停盜版素材數據庫、留存完整憑證、以及開展第三方溯源審計,以確保其數據合規體系的真實有效。Anthropic的妥協與整改並非個案,而是整個AI行業在數據合規上面臨系統性危機的縮影。近兩年,AI廠商粗放式、無授權的抓取訓練數據模式,已持續觸發創作者與出版機構的大規模維權行動。根據最新全球版權訴訟彙總數據,截至2026年5月,全球在審AI版權相關訴訟共計112起,其中近八成案件集中在美國本土。
矛盾之所以如此尖銳,根本原因在於大模型的迭代升級高度依賴海量文本,若每一本書都單獨找版權方簽約,研發成本將呈指數級暴漲;但另一方面,版權方也拿不出一套面向AI行業的統一授權窗口,普通作家更沒有與科技巨頭平等談判的籌碼。雙方陷入難以解開的死結——企業嫌授權太貴、太慢,創作者則憤慨被「白嫖」且無處說理。國際複製權組織聯合會(IFRRO)的調查發現,近八成作家和機構對AI未經許可的抓取行為表示擔憂,其中超過七成受訪者認為,矛盾的根源在於AI公司版權意識的缺失。魏先生進一步指出,這種擔憂的核心在於AI的「模仿」正在侵蝕原創的根基。不僅限於文字領域,AI對圖像、音樂等藝術形式的模仿同樣對原創構成威脅。
許多繪圖AI模型的訓練數據也來自藝術家的創作,但藝術家們是否同意將自己的作品作為數據源?訓練出的AI作品在畫風上與原作者相差無幾,這本身就是對畫家創意的一種危害和侵犯。他建議未來需要建立更清晰的標識體系,例如創作者可以明確標註其作品「不允許AI抓取」,而AI生成的內容也應被明確標識出來,以便公眾區分。只有理清這些界限,才能構建一個健康的創作生態。海外15億美元的天價罰單,不僅是Anthropic的教訓,更為全球大模型企業敲響警鐘。中國《生成式人工智能服務管理暫行辦法》第七條明確規定,生成式AI服務商必須使用具備合法來源的訓練數據,並留存完整的溯源臺賬。然而,規定與現實之間仍存在差距。
中國信息通信研究院白皮書指出,頭部大廠92%已搭好合規骨架,但中小公司的合規率不到二成。2026年,國內AI版權案件暴漲216%,其中41%的糾紛導火索與本次Anthropic案件如出一轍。這組數據精準點出國內AI產業在合規轉型期的隱患:當頭部企業已將合規視為生存底線時,大量中小公司仍深陷「先上車後補票」的慣性思維,將盜版數據視為降低研發成本的捷徑。今年6月,千餘名網文作者共同簽署《網絡文學反抄襲倡議書》,直指AI洗稿、惡意搬運等新型侵權亂象,呼籲平臺建立更嚴格的審查機制。
同月,國家版權局等四部門聯合啟動「劍網2026」專項行動,明確將人工智能領域的版權整治列為重點,嚴厲打擊利用AI工具進行「洗稿」「魔改」等違法行為。在司法實踐上,上海市高級人民法院5月發佈了全國首例AI洗稿刑事案,以非法經營罪對涉案團伙判刑,明確了「技術中立不阻卻刑事責任」的司法導向。在社會關注、平臺監管與法律重拳的共同推動下,國內大模型企業正在加速糾錯補漏。中國信息通信研究院發佈的白皮書數據顯示,2025年國內合規中文語料市場規模已達32.6億元,同比增速超過40%。一個正規的版權授權市場正在形成。
對國內大模型企業而言,越早將數據溯源和授權系統打造成基礎能力,就越能避免在模型進入規模化商業階段後,為早期的數據捷徑支付更為高昂的代價。海外市場的現狀同樣印證了這一趨勢。Omdia的數據顯示,當前合規數據授權成本已佔據海外頭部大模型總研發投入的35%,預計到2026年末,這一比例將攀升至45%。這意味著,未來用戶支付的AI訂閱費中,將有近一半並非用於算力消耗,而是為合法使用數據買單。隨著過去野蠻生長的低成本路徑徹底走不通,一場「搶版權」的軍備競賽已悄然開啟。各大廠商正瘋狂與出版集團簽署長期協議,批量採購合規語料,以此構築產品護城河。
2026年5月,由中國大百科全書出版社牽頭,人民出版社、人民文學出版社、中信出版集團等首批22家權威單位,聯合簽署了《人工智能高質量語料庫建設公約》,確立了「先授權,後使用」的行業底線。未來,創作者或許無需再單打獨鬥地維權,而是透過集體管理組織統一向AI公司發放年度許可,並根據實際使用頻次進行分帳。這不僅是解決海量數據授權難題的終極方案,更是重塑健康AI創作生態的必由之路。從「先用了再說」到「先授權再用」,在國內外司法判例與監管行動的共同催化下,AI行業的數據合規之路,方向已經明確。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。

內部賽馬暫停,騰訊、阿里、字節AI辦公產品“合兵”對陣
過去半年,騰訊、阿里巴巴、字節跳動等大廠在AI辦公產品領域經歷內部賽馬後,近期紛紛收攏資源,推出整合方案。騰訊將QClaw業務調整至雲產品六部,與WorkBuddy統一管理;阿里整合三款產品推出千問辦公;字節則將飛書團隊併入豆包。市場數據顯示,6月國內AI辦公智能體平臺月訪問量突破6000萬次,顯示此領域競爭日益激烈。