Google Gemini侵權風暴:出版商為何集體怒告科技巨頭的AI訓練黑箱?

李文明

2026-07-20

當數位化承諾變成AI訓練的免費午餐

2004年Google圖書計畫啟動時,出版商們或許沒想過,那些為了「讓世界知識更易取得」而授權數位化的書籍,二十年後會成為訓練商業AI模型的養分。由Hachette、Cengage、Elsevier等出版巨頭組成的聯盟,近日在紐約南區聯邦法院對Google提起集體訴訟,指控其Gemini AI模型未經許可使用了數百萬本受版權保護的書籍。

「合理使用」的界線戰爭

這不是第一場AI著作權戰役。去年Anthropic以15億美元和解類似訴訟,《紐約時報》對OpenAI的訴訟仍在進行。有趣的是,Google被控利用的正是當年出版商為Google圖書計畫提供的內容——當初協議僅允許顯示片段,如今卻成了訓練數據。

從產業面來看,這場訴訟暴露了兩個根本矛盾:數位化協議的時效性(2000年代的條款能否規範2020年代的AI應用?)與「合理使用」原則的模糊地帶。當AI公司主張訓練數據屬於「研究用途」,版權方看到的卻是商業產品背後的巨額利潤。更關鍵的是,若法院最終判定AI訓練需逐本授權,將徹底改變現有AI開發模式——這或許正是出版商發動法律戰的深層目的。

數據飢渴的AI與版權覺醒的內容產業

訴訟文件中引述的Google內部評估顯示,該公司早預見可能面臨「數千萬至數十億美元」罰款。這解釋了為何《今日美國》CEO Mike Reed放話可能將內容撤出Google搜尋——當爬蟲既服務搜尋又餵養AI,內容方的容忍已到極限。Cloudflare九月將自動封鎖爬蟲的決策,更顯示防禦戰線正在擴大。

這場訴訟真正要爭的是什麼?

表面上是賠償金問題,實質是商業規則制定權之爭。出版商擔心的不只是銷售流失,更是AI生成內容對授權市場的侵蝕。當Gemini能產出「類教科書」內容,誰還需要向Elsevier購買學術期刊?有趣的是,Google已與美聯社建立授權合作,卻遲未與圖書出版商達成類似協議——這種選擇性授權策略,恐怕才是點燃戰火的真正導火線。

下次當你驚嘆AI的強大能力時,不妨想想:那些讓機器變聰明的「知識」,有多少是未經許可取得的?這場訴訟或許能為數位時代的知識倫理,劃下一條遲來的界線。

本文改寫整理自公開新聞來源,原始報導由Yahoo奇摩新聞發布。

常見問題 FAQ

Google為什麼會被出版商控告?

出版商指控Google未經授權使用其受版權保護的書籍內容來訓練Gemini AI模型,違反最初僅允許數位化展示片段的協議。

這起訴訟可能造成什麼影響?

若法院判決出版商勝訴,可能迫使AI公司改變訓練數據取得方式,甚至需逐本取得授權,大幅提高AI開發成本。

Google如何回應這些指控?

目前Google尚未正式回應,但根據Meta在類似案件中的辯詞,科技公司可能主張AI訓練屬於「合理使用」範圍。

※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。