深潮 TechFlow 消息,7 月 22 日,多名作家在 2024 年发起集体诉讼,指控 Anthropic从 LibGen 等“影子图书馆”批量下载数百万份盗版电子书,并将其中约 48.2 万部受版权保护的作品纳入 Claude 训练资料库。法院随后把“模型训练”与“数据获取”拆开认定:AI 读取合法取得的书籍进行学习,可能属于合理使用;但通过盗版网站下载并长期储存作品,本身构成侵权。Anthropic 最终同意支付 15 亿美元和解,平均每部作品补偿约 3000 美元,并销毁相关盗版文件。
然而,Anthropic 此前多次指责部分中国 AI 团队通过 API 提取 Claude 输出进行模型蒸馏,称其破坏知识产权规则。两种行为在法律上并不完全相同,但形成了鲜明反差:面对人类作品,AI 公司强调模型有权学习;面对自身模型输出,又要求更强的排他保护。所以核心边界是:AI 训练未必违法,但训练数据的取得方式必须合法。(金十)




