出版商與作家集體起訴谷歌盜用版權內容訓練Gemini,內部文件曾預警千億罰款風險
重點摘要
AI資訊AI新閒資訊正文出版商與作家集體起訴谷歌盜用版權內容訓練Gemini,內部文件曾預警千億罰款風險發布於AI新閒資訊時間 :Jul 15, 2026閱讀 :1分鐘一群出版商和作家已對谷歌提起集體訴訟,指控其未經授權使用版權作品訓練AI平臺Gemini。原告方包括Hachette Livre、Cengage Group、Elsevier、作家Scott Turow及S.C.R.I.B.
# 出版商與作家集體起訴谷歌盜用版權內容訓練Gemini,內部文件曾預警千億罰款風險
一群出版商和作家已對谷歌提起集體訴訟,指控這家科技巨頭未經授權使用大量版權作品訓練其AI平臺Gemini。這起訴訟於美國紐約南區聯邦地區法院正式提交,成為AI版權爭議領域又一重大案件,引發業界廣泛關注。 原告方包括Hachette Livre、Cengage Group、Elsevier等知名出版商,以及著名作家Scott Turow和S.C.R.I.B.E.等組織。訴訟文件指出,谷歌多年來以「合理使用」為名,大規模掃描和儲存數百萬本受版權保護的書籍,但這些作品最終被用於訓練其人工智慧模型,遠遠超出原始授權範圍。 ## 指控谷歌故意隱瞞侵權行為
訴訟中最引人注目的指控是,谷歌被指曾故意刪除或修改作品中的版權管理資訊,以「掩蓋Gemini模型基於被盜資料訓練的事實」。原告方認為,這一做法顯示谷歌明知其行為存在版權爭議,卻仍選擇以隱瞞手段規避法律責任。 根據訴訟文件,出版商和作者過去長期向谷歌提供版權作品,目的是讓書籍能夠通過Google Books進行搜索,方便讀者查找和瀏覽。然而在Google Books平臺上,搜索結果僅提供有限的文本片段和目錄資訊,用戶根本無法查看整本書的完整內容。原告方認為,谷歌當時取得的授權範圍極為有限,絕不包含後續用於AI模型訓練的用途。 ## 兩大來源成訓練資料庫
訴訟文件詳細揭示了谷歌取得訓練素材的兩大來源。首先是Google Books,谷歌在過去二十年間掃描了數千萬本圖書,建立了全球最大的數位化圖書資料庫。原告指出,這些掃描複本最初僅供有限搜尋使用,但谷歌卻在未獲得額外授權的情況下,直接將這些完整的數位化書籍內容輸入Gemini模型進行訓練。 其次是Google Play商店。原告指控谷歌同樣使用了上傳至Google Play商店中的書籍內容進行訓練,儘管從未向版權所有者取得相關授權或支付任何費用。這些來自付費平台的書籍內容,同樣未經允許被用於人工智慧模型的開發和優化。 ## 內部文件曝光鉅額罰款風險
訴訟中最具震撼力的證據,莫過於原告引用的谷歌內部文件。這些文件顯示,谷歌自身早已意識到使用版權書籍訓練AI可能帶來「嚴重問題」,並面臨「數百億美元至數千億美元的潛在罰款」。 文件當中,谷歌的法務和合規團隊曾明確警告高層,如果被認定為故意侵犯版權,根據美國版權法的法定賠償條款,每件作品的賠償金額最高可達15萬美元。考慮到谷歌可能使用了數百萬件版權作品進行訓練,潛在的賠償總額將是天文數字。然而,谷歌最終仍決定繼續使用這些爭議資料進行訓練。 ## 「合理使用」抗辯再受挑戰
這起訴訟是版權持有者針對AI公司發起的眾多訴訟之一,谷歌、Meta、OpenAI和Anthropic均面臨類似糾紛。然而美國法院對於AI訓練是否構成「合理使用」的立場,目前仍存在重大分歧。美國加州法院此前曾有兩起早期裁決傾向於支持AI公司,認為使用版權內容訓練AI模型可被視為「合理使用」。這些裁決一度讓科技業感到振奮,認為AI訓練可能獲得法律上的保護傘。但近期的發展卻顯示情況並不明朗,Anthropic曾因訓練AI時盜用版權作品被處以高達15億美元的罰款,成為美國版權法歷史上金額最高的賠償案例。
在那起案件中,約50萬名作者符合資格每人至少獲得3000美元賠償,顯示法院對於大規模版權侵權的懲罰力度正在加大。這次針對谷歌的訴訟在美國紐約南區聯邦地區法院提起,意味著另一位法官將有機會對AI訓練是否屬於合理使用發表不同意見,可能為這場法律戰役開闢新的戰線。## 出版界與科技巨頭的對抗升級
此次集體訴訟的原告之一Scott Turow,是美國著名作家和律師,他的加入為訴訟增添了更多法律專業性和公眾關注度。S.C.R.I.B.E.則是一個代表作家權益的組織,長期關注版權保護議題。加上Hachette Livre、Elsevier等重量級出版商,原告陣營實力不容小覷。業內分析人士指出,這起訴訟的結果將直接影響整個AI產業的發展方向。如果法院裁定谷歌敗訴,那麼所有使用版權資料訓練AI模型的科技公司都將面臨類似的法律責任,可能引發連鎖訴訟潮。反之,如果谷歌成功以「合理使用」抗辯,則可能為AI產業打開一條合法使用版權資料的通道。截至發稿時,谷歌尚未對此次訴訟發表正式回應。
考慮到案件涉及的法律問題極為複雜,加上訴訟金額可能高達數千億美元,預料這場官司將耗時數年,最終可能上訴至美國最高法院才能塵埃落定。## 產業影響深遠
這場訴訟的發展也將對整個AI產業的商業模式產生深遠影響。目前,包括OpenAI、Meta、Anthropic在內的多家AI公司,都依賴大規模的文本資料訓練其語言模型。如果版權爭議遲遲無法解決,這些公司可能被迫改變訓練方式,轉而使用授權資料或公共領域作品,這將大幅提高AI模型的開發成本,並可能影響模型的性能和品質。 另一方面,出版業和作家群體則希望通過這場訴訟確立一個原則:創作者的作品不能被科技公司無償拿走用於商業開發。原告方主張,AI公司應像其他行業一樣,合法取得授權並支付合理費用,才能使用版權內容進行模型訓練。 隨著AI技術持續快速發展,版權問題已成為制約產業發展的關鍵瓶頸。這場谷歌訴訟案的最終判決,很可能會為整個AI產業建立一個重要的法律先例,影響未來數十年人工智慧技術的發展路徑。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。