據路透社報道,美國聯邦法院週一正式批准Anthropic公司與作家、出版商達成的15億美元集體訴訟和解協議。該協議用於解決Anthropic因訓練AI模型過程中涉嫌侵犯版權引發的訴訟,公司隨後將開始向相關版權方支付賠償。
美國加州北區地方法院法官Araceli Martinez-Olguin簽署了最終批准文件。此前,已退休法官威廉·阿爾蘇普曾初步批准該和解方案,並裁定Anthropic曾非法下載並存儲數百萬本受版權保護的書籍。
根據賠償方案,每部涉案作品預計可獲得3000美元賠償,涉及作品數量約50萬部,賠償金額將由擁有版權的作者和出版商共同分配。這一金額被認爲是美國版權法領域規模最大的和解之一。

不過,該協議並未完全解決圍繞AI訓練數據的法律爭議。阿爾蘇普法官此前在案件核心問題上支持Anthropic,認爲利用受版權保護文本訓練AI模型可能屬於“合理使用”範疇,被業內視爲AI版權判例的重要進展。但與此同時,他指出Anthropic獲取部分訓練數據的方式存在違法問題。
Anthropic此前主要通過兩種方式獲取訓練數據:一部分來自合法購買並掃描的書籍,另一部分則來自Library Genesis、Pirate Library Mirror等盜版網站下載的內容。法院認爲,後者涉及非法獲取版權材料。爲避免進一步審判以及可能面臨的高額賠償,Anthropic最終選擇達成和解。
業內人士指出,雖然此次和解結束了該案件,但並未形成針對整個AI行業的統一法律標準。由於Anthropic選擇和解,案件未進入上訴程序,阿爾蘇普此前關於AI訓練“合理使用”的判斷也不會成爲具有約束力的司法先例。
目前,圍繞AI模型訓練數據版權問題的訴訟仍在持續,包括針對谷歌、Meta、Midjourney和OpenAI等公司的相關案件。近期,Hachette、Cengage、Elsevier、作家Scott Turow以及SCRIBE等出版機構和作者還聯合起訴谷歌,指控其未經授權使用版權作品訓練Gemini人工智能平臺。
隨着生成式AI快速發展,如何平衡模型訓練需求與版權保護,正成爲全球AI產業面臨的重要法律與商業挑戰。Anthropic和解案雖然提供了一種解決路徑,但行業關於AI數據合規的長期規則仍待進一步明確。
