當 Anthropic 被揭發使用盜版書籍訓練 AI 模型的那一刻,整個科技界震驚了。美國人工智慧公司 Anthropic 旗下的大型語言模型 Claude,被控從盜版網站下載數百萬本受著作權保護的書籍,最終支付了 15 億美元的和解金。
表象
表面上看,這起案件似乎只是一場普通的著作權侵權訴訟。然而,事情遠比表面複雜得多。Anthropic 不僅從創世紀圖書館(Library Genesis)及 Pirate Library Mirror 等盜版平台下載書籍,還花費數百萬美元購買大量紙本書籍,拆除書脊、裁切每頁並掃描成數位檔案,最後銷毀原書。這些行為暴露了公司在追求技術進步時,對法律和道德邊界的漠視。
真相
事實上,Anthropic 在內部文件中明確表示,他們清楚使用盜版書籍可能帶來的法律風險,但仍選擇保留這些資料。公司原本希望通過合法途徑獲取更多內容,甚至提出建立「世界上所有書籍」的資料庫,但由於授權過程困難重重,最終選擇了這條捷徑。
“根據 Anthropic 的内部文件,公司清楚使用盜版書籍可能帶來的法律風險,但仍選擇保留這些資料。”
各方角力
這起訴訟不僅涉及 Anthropic 和著作權持有者之間的糾紛,還凸顯了科技巨頭與法律體系之間的角力。美國加州北區聯邦法院在判決中指出,若公司合法購買紙本書,再將內容數位化供 AI 訓練使用,即使紙本遭銷毀,仍可構成合理使用。然而,Anthropic 下載超過 700 萬本盜版書籍,並建立永久保存的中央圖書館,已經超出了合理使用的範圍。
“美國加州北區聯邦法院認為,Anthropic 下載超過 700 萬本盜版書籍,並建立永久保存的中央圖書館,已經超出了合理使用的範圍。”
深層影響
這起案件的影響遠不止於 Anthropic 本身。它揭示了全球 AI 發展中對內容著作權保護的重視,以及科技公司在追求技術進步時面臨的道德困境。未來,其他 AI 公司在數據收集和使用方面將更加謹慎,以避免類似法律糾紛。
從產業面來看,這起案件將迫使科技公司重新評估其數據收集和使用的策略,以確保符合法律和道德標準。同時,著作權持有者也將更加警惕,並積極捍衛自己的權利。
未解之問
儘管 Anthropic 已支付鉅額和解金,但這起案件仍留下許多未解之問。例如,如何平衡技術進步與著作權保護?未來 AI 訓練資料的合法來源是否會成為新的瓶頸?這些問題值得我們深入思考。
行動呼籲
在科技迅速發展的今天,每個人都應關注技術進步對社會的影響。如果你是內容創作者,請積極捍衛自己的著作權;如果你是科技公司的員工,請確保公司的數據收集和使用符合法律和道德標準。只有這樣,我們才能共同推動科技的健康發展。
本文改寫整理自公開新聞來源,原始報導由自由時報發布。
常見問題 FAQ
Anthropic 為什麼會使用盜版書籍訓練 AI 模型?
Anthropic 之所以使用盜版書籍,是因為合法獲取內容的過程困難重重,而盜版書籍可以提供大量的訓練資料。
這起訴訟的和解金是多少?
Anthropic 同意支付 15 億美元的和解金。
這起案件對未來 AI 發展有何影響?
這起案件將迫使其他 AI 公司在數據收集和使用方面更加謹慎,以避免類似的法律糾紛。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。

