美國人工智慧公司 Anthropic 因使用盜版書籍訓練 AI 模型,被裁定需支付高達 15 億美元的和解金。
盜版書籍訓練 AI 的代價
Anthropic 旗下的大型語言模型 Claude 在訓練過程中,被控使用了約 50 萬部盜版書籍,這些書籍主要來自創世紀圖書館(Library Genesis)及 Pirate Library Mirror 等非法平台。據法院判決書顯示,Anthropic 早在 2021 年就從 Books3 資料庫下載了 196,640 本未經授權的書籍,隨後又從 LibGen 下載了至少 500 萬本書籍,2022 年再取得 200 萬本內容,累計超過 700 萬本盜版書籍。
內部文件揭露
Anthropic 內部文件顯示,公司清楚知道使用盜版書籍可能帶來的法律風險,但仍選擇保留這批資料,並計劃建立一個永久保存的中央圖書館。法院指出,數百名工程師都能存取這些盜版內容,甚至可以建立額外副本供其他用途使用。
合法購書的嘗試
Anthropic 曾試圖通過合法途徑獲取訓練資料,甚至提出建立「世界上所有書籍」資料庫的構想,但由於授權過程不如預期,最終轉向大量購買紙本書的方式。公司投入數百萬美元購買大量紙本書籍,再委託第三方拆除書脊、裁切每一頁並掃描為數位檔,雖然紙本遭銷毀,但這些內容仍被用於 AI 訓練。
法院的裁決
美國加州北區聯邦法院認為,若公司合法購買紙本書,再將內容一對一數位化供 AI 訓練使用,即使紙本遭銷毀,仍可構成合理使用。然而,Anthropic 从盜版网站下载超过 700 萬本书籍,并建立永久保存的中央圖書館,已超出合理使用的範圍,因此被判處支付 15 億美元和解金。
從產業面來看,Anthropic 的案例凸顯了全球 AI 發展中對內容著作權保護的重視。盜版書籍的使用不僅侵犯了作者和出版社的權益,還可能對整個出版生態造成嚴重影響。企業在追求技術進步的同時,必須更加謹慎地處理版權問題。
行動呼籲
這起案件提醒我們,AI 技術的發展不能以犧牲著作權為代價。作為讀者和消費者,我們也應支持正版內容,共同維護創作者的權益。
本文改寫整理自公開新聞來源,原始報導由自由時報發布。
常見問題 FAQ
Anthropic 為什麼需要支付 15 億美元的和解金?
Anthropic 因使用盜版書籍訓練 AI 模型,被裁定需支付高達 15 億美元的和解金。
Anthropic 使用了多少盜版書籍進行訓練?
Anthropic 使用了超過 700 萬本盜版書籍進行訓練。
法院是如何裁定 Anthropic 的行為超出合理使用的範圍?
法院認為,Anthropic 从盜版网站下载超过 700 萬本书籍,并建立永久保存的中央圖書館,已超出合理使用的範圍。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。











