Anthropic 因盗版书籍支付 15 亿美元和解金,创下集体诉讼版权赔偿纪录

联邦法院批准 Anthropic 与图书作者的 15 亿美元集体诉讼和解,创下版权类集体诉讼最高赔偿纪录。该和解明确惩罚的是使用盗版数据库训练模型的行为,而非 AI 训练本身,这为整个 AI 行业在“使用盗版数据”与“合理使用合法数据”之间划出一条更清晰的界限。

Anthropic 因盗版书籍支付 15 亿美元和解金,创下集体诉讼版权赔偿纪录

一句话看懂:联邦法院批准 Anthropic 与图书作者的 15 亿美元集体诉讼和解,创下版权类集体诉讼最高赔偿纪录。该和解明确惩罚的是使用盗版数据库训练模型的行为,而非 AI 训练本身,这为整个 AI 行业在“使用盗版数据”与“合理使用合法数据”之间划出一条更清晰的界限。

事件核心:发生了什么

加州旧金山联邦法院正式批准了 Anthropic 与图书作者的集体诉讼和解方案。Anthropic 被认定在 2021 至 2022 年间,从盗版数据库 LibGen 和 PiLiMi 下载了约 48.2 万本受版权保护的图书用于训练。根据和解协议,Anthropic 需支付 15 亿美元赔偿金,其中约 91.3% 的版权利害关系人获得平均每本约 3000 美元的赔偿,是法定最低赔偿额的四倍。Anthropic 还被要求销毁这些盗版文件的副本。此外,作者保留对 AI 输出内容中再现原作品部分的主张权,以及对 Anthropic 未来行为的追究权。

为什么重要

这是版权集体诉讼史上最高额的和解记录,但其影响远不止于赔偿金额。案件的核心判罚逻辑在于:法官 William Alsup 此前已明确裁定,使用合法获取的图书进行 AI 训练属于“变革性使用——极具变革性”,构成合理使用。本次 15 亿美元赔偿专门针对“使用盗版数据源”这一不合法行为,而非否定 AI 训练作为合理使用的法律基础。这意味着,对于依赖互联网公开内容(如网页、文章)进行训练的 AI 公司,这一判例反而是一个重大利好——只要数据获取手段合法,公平使用抗辩的空间依然存在。目前,对于大规模爬取互联网内容而未取得作者同意是否算“合法获取”,尚无统一司法定论,该问题将成为下一阶段争议焦点。

对用户/开发者/创作者的影响

对开发者和 AI 公司: 合规成本将实质性上升。各实验室必须更严格审查训练数据集的来源,尤其是大规模爬虫获取的、来源不明的语料。使用开源数据集时,也需确认其原始版权状态,否则可能面临类似赔偿风险。对于有预算购买授权数据的公司,此案增加了它们相对于利用灰色数据源的竞争者的法律确定性。对内容创作者: 此案确立了明确的维权路径:作者无法阻止 AI 在合法数据学习(合理使用)下的训练,但可以追究“使用盗版数据”的直接侵权责任。这为创作者提供了保护核心资产(书籍、文章)的更强法律武器。对普通用户: 短期内不会直接影响用户使用对话模型,但长期来看,若更多授权协议达成,模型在文学性、专业性长文本的生成质量可能会因合法数据可用性差异而产生分化。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

1. 其他模型厂商的风险警示: 目前已有多起针对 OpenAI、Meta、Google 等的类似集体版权诉讼仍在审理中。Anthropic 和解案中关于“盗版数据直接赔偿,合法训练适用合理使用”的司法逻辑,可能会被其他法院援引,加速同类案件进入和解或裁决阶段。2. 透明化训练数据披露的压力: 欧盟 AI 法案和美国版权局近期均要求 AI 公司披露训练数据来源。此次高额赔偿可能倒逼更多公司主动公开数据集构成,以避免后续“被动发现盗版数据”的更大损失。3. 授权内容市场价值重估: 15 亿和解金(约每本 3000 美元)为批量内容的商业授权价格提供了新参照。若未来立法要求对合法获取的公开网络内容付费才能用于训练,该数字意味着千亿级市场空间的开启。

来源:The Decoder:AI News(RSS)

celebrityanime
celebrityanime
文章: 14755

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注