15 億美元賠償!Anthropic 盜版書籍訓練 AI 模型引發著作權風暴

李文明

2026-07-30

當 Anthropic 旗下大型語言模型 Claude 被控使用盜版書籍進行訓練的那一刻,全球 AI 領域的著作權爭議再次成為焦點。這起集體訴訟案揭露了 Anthropic 在訓練 AI 模型過程中,涉及大量盜版書籍的使用,最終以高達 15 億美元的和解金落幕。

表象

Anthropic 被指控從創世紀圖書館(Library Genesis)及 Pirate Library Mirror 等盜版平台下載書籍,用於其 AI 模型的訓練。這些書籍包括約 50 萬部受著作權保護的作品,其中 2021 年下载了 Books3 資料庫,內容包含 196,640 本未經授權書籍;2022 年再從 LibGen 下载至少 500 萬本書籍,累計超過 700 萬本來自未經授權的盜版網站。

真相

Anthropic 內部清楚來自盜版網站的資料可能帶來法律風險,依然選擇保留這批資料,並非一次性的 AI 訓練資料,而是計劃建立永久保存的中央圖書館。法院指出,數百名工程師都能存取這些內容,甚至可以建立額外副本供其他用途使用。

「Anthropic 的行為不僅侵犯了著作權,還展示了公司在追求技術進步時對法律邊界的漠視。」 —— 美國加州北區聯邦法院判決書

各方角力

Anthropic 為建立 AI 訓練資料,最初希望取得更多合法內容,甚至提出建立「世界上所有書籍」資料庫的構想,但授權結果不如預期。隨後,Anthropic 投入數百萬美元購買大量紙本書籍,再委託第三方拆除書脊、裁切每一頁並掃描為數位檔。法院認為,若公司合法購買紙本書,再將內容一對一數位化供 AI 訓練使用,即使紙本遭銷毀,仍可構成合理使用。

深層影響

這起訴訟案突顯了全球 AI 發展中對內容著作權保護的重視。 Anthropic 的行為不僅侵犯了著作權,還對出版業和作者造成了巨大損失。此案件的判決結果,可能會對未來 AI 訓練資料的獲取方式產生重大影響。

「從產業面來看,這起訴訟案將迫使 AI 公司更加謹慎地處理著作權問題,未來的訓練資料獲取方式可能會更加透明和合法。」 —— 編輯觀點

未解之問

儘管 Anthropic 已經支付了高昂的和解金,但這起訴訟案仍留下了一些未解之問:未來 AI 訓練資料的獲取方式是否會受到更嚴格的監管?出版業和作者的利益如何在 AI 發展中得到更好的保護?這些問題值得我們深思。

在這個快速變化的 AI 時代,我們需要更多這樣的案例來引導產業發展,確保技術進步不會犧牲創作者的權益。如果你對 AI 著作權問題有獨特看法,歡迎留言分享你的意見。

本文改寫整理自公開新聞來源,原始報導由自由時報發布。

常見問題 FAQ

Anthropic 为什么使用盗版书籍训练 AI 模型?

Anthropic 未能成功获得足够的合法授权内容,因此选择从盗版网站下载大量书籍用于 AI 训练。

这起诉讼的结果是什么?

Anthropic 同意支付 15 億美元的和解金,并停止使用盗版书籍进行 AI 训练。

这起案件对 AI 行业有何影响?

这起案件可能会促使 AI 公司更加谨慎地处理著作权问题,未来的训练数据获取方式可能会更加透明和合法。

※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。