近日美國聯邦法院正式批准 Anthropic 支付 15 億美元(約新台幣 487 億元)版權和解金,創下美國史上最大規模的版權訴訟和解紀錄。這起案件源於 Anthropic 訓練 Claude AI 模型時,從盜版網站下載超過 700 萬本書籍,更花費數百萬美元購買實體書、拆解掃描後銷毀原書。法院判決書中的細節令人震驚:一家以「AI 安全」為品牌核心的公司,在知道書籍來源是盜版的情況下,依然選擇保留全部檔案。
Anthropic下載700萬本盜版書訓練 Claude
法院判決書揭露了 Anthropic 取得訓練資料的完整路徑,2021 年初,聯合創辦人 Ben Mann 親自下載了 Books3 資料集,內含 196,640 本未經授權的書籍。同年 6 月,他又從知名盜版網站 Library Genesis(LibGen)下載至少 500 萬本書。2022 年 7 月,Anthropic 再從另一個盜版網站 Pirate Library Mirror(PiLiMi)下載至少 200 萬本。累計超過 700 萬本書全部來自盜版管道,Ben Mann 和 Anthropic 都清楚知道全部書籍是盜版的。
法官 William Alsup 在判決中直接寫道,Anthropic 明明有很多合法管道可以取得書籍,卻「preferred to steal them」(偏好偷取),因為這樣可以避開 Dario Amodei 所說的法律、實務和商業麻煩。累計下載的盜版書數量超過 700 萬本,涵蓋範圍之廣令人咋舌。
買書、拆書、掃描、銷毀
除了下載盜版書,Anthropic 另一條取得訓練資料的路線更令人咋舌。該公司花費數百萬美元大量購買實體書,然後僱人拆除書脊、逐頁裁開,掃描成可檢索的數位 PDF 檔,最後將紙本原書全部丟棄。法官在判決書中的描述是:「The print original was destroyed. One replaced the other.」(紙本原件被銷毀,數位副本取而代之。)
2024 年,Anthropic 聘請了 Google 圖書掃描計畫的前合作負責人 Tom Turvey,任務是弄到「世界上的所有書」。他向幾家大型出版社發送電子郵件詢問 AI 訓練授權。法院認為,如果繼續談下去原本可能達成許可協議,但 Anthropic 高層讓版權談判直接中止,理由是談版權太麻煩,批量買書、拆書、掃描比較省事。
判決書揭露,Anthropic 內部後來已意識到法律風險,對繼續使用盜版書訓練模型有所顧忌,原因就是「法律問題」。但法官隨後寫了一句關鍵判詞:「It kept them anyway.」(它還是把它們留下了。)即使知道有問題,Anthropic 依然保留全部盜版書檔案。
更令人關注的是,Anthropic 將取得的所有書籍放入一個永久的「通用中央圖書館」,打算保留「forever」(永遠)。即使已經確定某些書永遠不會再用於訓練,也要繼續保存。法院指出,數百名工程師可以存取盜版書檔案,並為其他用途製作副本。法官甚至批評 Anthropic 在證據揭露上進行回避,試圖隱瞞內部運作的全貌。
合理使用與侵權的界線
2025 年 6 月 23 日,法官 Alsup 做出美國第一起針對生成式 AI「合理使用」的司法判決,將案件分為兩個層面。第一,使用書籍訓練 AI 模型本身屬於合理使用,因為具有「高度轉化性」。法官寫道,大型語言模型的目的是為了產出嶄新內容,就像渴望成為作家的讀者在閱讀中學習,沒有複製或取代原作品的意圖。合法購買實體書後數位化並銷毀原書,也屬於合理使用。
第二,從盜版網站下載超過 700 萬本書並建立永久保存的中央圖書館,不構成合理使用。法官認為,盜版書檔案起到了「付費副本替代品」的作用,不具有轉化性。Anthropic 後來買下一本此前從網路上偷來的書,也不能免除之前的盜版責任。
15 億美元和解的內容
Alsup 退休後,案件交由法官 Araceli Martinez-Olguin 負責。2026 年 7 月 20 日,她正式批准 Anthropic 與作者群達成的 15 億美元和解協議。和解涵蓋超過 48.2 萬本書,約 91% 已由作者或出版商提出申領,每本書平均可獲約 3,000 美元(約新台幣 9.7 萬元)補償。這是美國史上規模最大的版權訴訟和解紀錄,也是數十起 AI 版權訴訟中首宗達成重大和解的指標案件。
根據協議,Anthropic 將銷毀原始盜版檔案及任何副本,但公司仍保有合法購買並掃描的書籍的權利。英國出版社 Bloomsbury(哈利波特系列出版商)旗下 14,087 部作品涵蓋在和解範圍內,扣除約 10% 律師費及相關費用後,賠償金將由出版社與受影響作者平分。
AI 安全公司的道德矛盾
這起案件最諷刺之處在於,Anthropic 一直將自己定位為「更負責任、更注重安全」的 AI 公司。該公司天天向全世界宣導 AI 安全的重要性,卻在訓練資料取得上選擇了最不道德的路徑。Anthropic 並不是因為不知道版權規則才盜版,它知道正規授權管道在哪裡,也知道書籍是盜版,更知道繼續使用存在法律風險。它只是覺得走正規流程太麻煩。
這項判決也為 AI 產業劃下重要界線:用合法取得的書籍訓練 AI 屬於合理使用,但從盜版網站取得書籍則必須承擔法律後果。目前 OpenAI、Microsoft、Meta 等公司都面臨類似的版權訴訟,Anthropic 案的判決結果將成為後續案件的重要參考指標。


