IT之家生成式AI

出版商與作者集體起訴谷歌,指控其盜用版權內容訓練 Gemini AI

2026年7月15日 15:36
出版商與作者集體起訴谷歌,指控其盜用版權內容訓練 Gemini AI

重點摘要

一群出版商與作家對谷歌提起集體訴訟,指控該公司未經授權使用其版權作品訓練Gemini AI,並故意刪除版權資訊以掩蓋侵權事實。此案凸顯AI訓練涉及的版權爭議,在美國法院對「合理使用」認定仍存在分歧之際,成為又一備受關注的案例。

站內 AI 整理稿

# 出版商与作者联合起诉谷歌:指控其盗用版权内容训练Gemini AI

一群出版商和作家已在纽约南區聯邦地區法院對谷歌提起集體訴訟,指控這家科技巨頭未經授權使用他們的版權作品來訓練其人工智能平臺 Gemini。這起訴訟進一步加劇了創作者與大型科技公司之間關於 AI 訓練數據合法性的法律戰。原告方面包括國際知名出版商 Hachette Livre、Cengage Group、Elsevier,以及著名作家 Scott Turow 和 S.C.R.I.B.E. 等。 原告在訴狀中指出,谷歌不僅未經許可大規模複製受版權保護的書籍、文章和其他文字作品,還故意刪除或修改這些作品中的版權管理信息,企圖「掩蓋 Gemini 模型是基於被盜資料訓練而成的事實」。這種行為被指控為系統性侵權,違反了美國版權法的相關規定。 ## 版權訴訟潮中的最新一役

這起訴訟並非孤例。隨著生成式 AI 技術的爆發,出版商、作者以及其他版權持有者已向多家 AI 公司發起多起類似訴訟。目前,包括 Meta、OpenAI 和 Anthropic 在內的多家頭部人工智能企業都面臨著有關訓練數據版權的糾紛。整個行業正處於法律動盪期:創作者主張其作品被非法「盜用」用於訓練商業模型,而科技公司則多以「合理使用」(fair use)原則為自己辯護。不過,此類案件的法律環境仍然充滿不確定性。美國加州法院曾有兩起早期裁決傾向於支持 AI 公司,認為在現行版權法框架下,使用受版權保護的內容訓練 AI 模型可能構成合理使用。

但這些裁決既不意味著其他法院必須遵循,也未形成穩固的先例。法律界普遍認為,由於案件涉及高度複雜的技術問題和仍在演進的版權理論,這些早期判斷難以直接套用至所有情況。## 巨額罰款與集體訴訟的複雜博弈

值得注意的是,AI 公司並非總能勝訴。此前,Anthropic 因在訓練 AI 時盜用版權作品而被處以 15 億美元(約合 101.73 億元人民幣)的罰款,成為美國版權法歷史上金額最高的單筆賠償。據悉,約有 50 萬名作者符合該案的賠償資格,每人至少可獲得 3000 美元(約合 20346 元人民幣)。然而,不少作者選擇放棄領取和解賠償,希望繼續通過法律途徑追究 AI 公司在訓練模型過程中的系統性侵權問題。這顯示出版權持有群體內部存在分歧:部分人傾向於接受賠償了結,另一部分則希望藉由訴訟推動更有利的立法或判例。回到谷歌的案件,原告與谷歌之間存在更為複雜且長期的合作歷史。

訴訟文件指出,出版商和作者過去長期向谷歌提供版權作品,目的是讓這些書籍能夠通過 Google Books 進行搜索。但 Google Books 的服務模式本質上是「片段展示」,用戶無法查看整本書,只能獲得有限的文字片段及目錄信息。原告認為,谷歌後來背離了當初的授權範圍,將這些書籍副本用於訓練 Gemini 模型。此外,谷歌還使用了上傳至 Google Play 商店的書籍內容進行訓練,同樣沒有獲得相關授權。## 谷歌內部文件曝光:高風險的AI訓練

訴狀中引用了一份據稱來自谷歌內部的文件。該文件顯示,谷歌自身也意識到使用版權書籍訓練 AI 模型可能會帶來「嚴重問題」,並可能導致「數百億美元至數千億美元的潛在罰款」。這份內部文件成為原告指控谷歌「明知故犯」的核心證據。原告強調:「谷歌非法複製了所有這些受到限制用途約束的作品,並用於 AI 訓練,同時明知自己並未獲得這樣做的授權。」

截至目前,谷歌尚未對這起訴訟作出正式回應。外界認為,此次訴訟選擇在紐約南區聯邦地區法院提起,意味著一位新的法官將有機會對「AI 訓練是否屬於合理使用」發表與加州法院不同的意見。考慮到美國不同巡迴法院在法律解釋上可能存在差異,這個案件的走向可能對整個 AI 行業的數據合規策略產生深遠影響。 ## 在舊法與新技術之間掙扎

美國現行版權法律制定於互聯網尚未普及的年代,如何將其適用於 AI 時代已成為法律界和科技界激烈辯論的焦點。一方面,版權持有者強調作品被大規模複製和用於商業模型訓練,明顯超出合理使用的範疇;另一方面,AI 公司則主張訓練過程中的數據使用屬於轉換性使用(transformative use),應受到版權法的保護。這種根本分歧導致訴訟結果難以預測,也使企業在投入巨資開發大模型時面臨巨大的法律風險。在谷歌案件中,出版商與作者的訴求不僅是經濟賠償,更試圖從法律上明確限制 AI 公司未經授權使用版權內容的權利。

他們認為,如果允許科技公司任意使用受保護的作品來訓練商業模型,將嚴重損害原創內容的價值和創作者的生存基礎。這起訴訟不僅是對谷歌的挑戰,也是對整個 AI 產業數據獲取模式的一次根本性質疑。隨著案件進入審理程序,紐約南區聯邦地區法院的判決將成為繼加州法院之後又一個重要的風向標。無論結果如何,圍繞 AI 訓練數據的版權戰火顯然還將持續燃燒。而對於谷歌來說,這場訴訟不僅關乎數百億美元的潛在賠償,更關乎其 Gemini 模型及未來 AI 產品的合法性和商業模式的可持續性。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

1 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

2 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

2 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

2 小時前