多名作家在2024年發起集體訴訟,指控Anthropic從LibGen等“影子圖書館”批量下載數百萬份盜版電子書,並將其中約48.2萬部受版權保護的作品納入Claude訓練資料庫。法院隨後把“模型訓練”與“數據獲取”拆開認定:AI讀取合法取得的書籍進行學習,可能屬於合理使用;但通過盜版網站下載並長期儲存作品,本身構成侵權。Anthropic最終同意支付15億美元和解,平均每部作品補償約3000美元,並銷燬相關盜版文件。
Anthropic此前多次指責部分中國AI團隊通過API提取Claude輸出進行模型蒸餾,稱其破壞知識產權規則。兩種行爲在法律上並不完全相同,但形成了鮮明反差:面對人類作品,AI公司強調模型有權學習;面對自身模型輸出,又要求更強的排他保護。所以核心邊界是:AI訓練未必違法,但訓練數據的取得方式必須合法。