
一句话看懂:美国联邦法院正式批准了Anthropic与作者和出版商之间价值15亿美元的集体诉讼和解协议,涉及约50万部作品。这起诉讼的核心是Anthropic在训练其AI模型(如Claude)时,是否非法使用了受版权保护的文本数据。
事件核心:发生了什么
2026年7月,美国加利福尼亚州北区联邦地方法院法官Araceli Martinez-Olguin签署了这项和解协议的最终批准文件。此前,退休法官William Alsup已初步批准和解,并认定Anthropic曾非法下载和存储了数百万本受版权保护的书籍。根据补偿方案,每部受影响的作品预计将获得3000美元的赔偿,这些款项将由作品的权利人(作者和出版商)共享。值得注意的是,Anthropic获取训练数据的方式有两种:一部分来自合法购买和扫描的书籍,另一部分则来自Library Genesis和Pirate Library Mirror等盗版网站。法院认为后者属于违法行为。为避免进一步审判和可能的高额罚款,Anthropic最终选择了和解。
为什么重要
这笔15亿美元的赔偿金被认为是美国版权法领域最大规模的和解之一。然而,该协议并未完全解决围绕AI训练数据的法律争议。William Alsup法官在此前的一项关键裁定中支持了Anthropic的立场,认为使用受版权保护的文本来训练AI模型可能属于“合理使用”。这一裁定被视为AI版权案件中的一项重要发展。但恰恰因为Anthropic选择了和解,案件没有进入上诉程序,Alsup法官关于“合理使用”的裁决未能成为对整个AI行业具有约束力的法律判例。这表明,关于AI训练数据版权的法律标准仍然悬而未决。
对用户/开发者/创作者的影响
对内容创作者:此和解为在AI训练中使用其作品的作者和出版商提供了直接的金钱补偿,表明未经授权的数据使用将面临巨大的商业和法律成本。但这并未确立一个通用的法律标准,未来类似诉讼的结果仍存在不确定性。对开发者/企业:这起案例再次提醒开发者和企业,在使用公开数据集或爬取网络数据训练模型时,需要严格审查数据来源的合法性。直接使用来自盗版网站或未经授权的大规模语料库,即使模型本身可能适用“合理使用”抗辩,数据获取方式的不当仍可能带来巨额赔偿风险。对普通用户:短期内,该和解不太可能直接影响AI产品的功能或价格。但从长期看,它将推动整个行业更谨慎地处理训练数据,可能促使更多模型开发者转向使用授权或合成数据,间接影响AI模型的知识广度和生成内容的多样性。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
1. 其他公司的版权诉讼走向:目前针对Google、Meta、Midjourney和OpenAI等公司的同类诉讼仍在进行中。Anthropic的和解方案是否会促使其他公司选择类似路径,还是继续坚持“合理使用”的抗辩,是观察行业风向的关键。
2. 数据合规的商业模式变化:此案后,市场是否会加速出现更多提供合法授权数据集的第三方平台?企业采购AI服务时,是否会明确要求供应商承诺训练数据的版权合规性?
3. 判例法的空白如何填补:由于本案未能形成有约束力的上诉判例,未来由哪个案件能推动美国最高法院对“AI训练使用版权作品是否属于合理使用”做出最终裁决,是行业和法律界共同关注的焦点。
来源:AIbase


