二手书销量激增,是因为AI吗?

全球独立书商近期出现大批量购入二手书的异常订单,这些书籍可能并非流向普通读者,而是被用于AI大模型的训练数据采集。事件背后,是Anthropic在版权诉讼中披露的“Project Panama”项目,以及随之而来的销毁式扫描争议。

一句话看懂:全球独立书商近期出现大批量购入二手书的异常订单,这些书籍可能并非流向普通读者,而是被用于AI大模型的训练数据采集。事件背后,是Anthropic在版权诉讼中披露的“Project Panama”项目,以及随之而来的销毁式扫描争议。

事件核心:发生了什么

据BBC News报道,过去几个月,英国、北美等多地独立书店出现反常的批量购书潮。经营近30年的诺森伯兰Barter Books书店老板Stuart Manley透露,一家加拿大公司的一笔订单量,就相当于其店铺正常一周的销量(2至3000本)。多位书商表示,这些订单中既有冷门的拉丁文古籍,也有早已无人问津的小说,主题随机、毫无规律。

书商们怀疑,这些书并非卖给海外读者,而是用于训练AI大模型。这一猜测的伏笔来自2025年美国法院的一项裁决:法官William Alsup裁定,Anthropic使用合法购得的书籍训练Claude不违反美国版权法,因为该使用具有“高度变革性”。随后解封的法庭文件显示,Anthropic内部将批量收集旧书并数字化扫描的项目称为“Project Panama”,目标是“以破坏性方式扫描全世界所有的书”——即拆毁书脊、高速扫描全部页面,再将残体回收。

为什么重要

这起事件首次让“二手书市场—版权法—大模型训练数据”这条暗线浮出水面。过去行业普遍默认AI训练语料主要来自网络公开数据、数据库或出版商授权内容,而此次披露表明,部分AI公司已转向收购实体旧书,以获取可能长期未被数字化的稀缺文本,充实大模型训练语料。

值得关注的是法律环境的显著差异:美国联邦法官认为用合法购得的书籍训练AI属于“变革性使用”,而英国牛津大学知识产权学者Emily Hudson指出,英国版权法的起点是“复制即需授权”。这意味着同一行为在不同司法辖区将面临截然不同的合规判断,AI训练数据的版权边界正在成为跨国AI公司必须处理的系统性风险。

对用户/开发者/创作者的影响

对开发者与AI企业:此案提供了一个重要窗口:在美国,购买实体书并扫描训练尚可争取“合理使用”司法支持,但在英国等司法辖区可能构成侵权。若需在全球范围部署大模型,数据获取路径需要更审慎地做属地化合规评估,而非简单复制美国企业的做法。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对内容创作者与出版方:如果你的作品以实体书形式流通,尤其是小众、绝版或图书馆仅存少量复本的著作,它可能成为AI公司的收购目标,并在未经明确授权的情况下进入训练语料。尽管美国判例暂时对AI公司有利,但作者和出版社应重新审视版权声明、销售渠道和数字权利授权条款,而非默认“卖出去的书只被人类阅读”。

对普通用户:二手书市场的异动不会直接影响日常AI产品使用,但它揭示了生成式AI服务(如Claude)的训练来源比公开披露的更广泛——在理解模型能力边界的同时,也应了解其训练数据背后可能存在的伦理争议。

值得关注的后续

目前公开信息显示,Anthropic否认其数据采集项目涉及收购并销毁珍本或古本书籍,但“Project Panama”的相关细节仍未完全披露。接下来可以重点观察三点:

其一,英国及其他欧洲国家是否会出现针对“实体书扫描训练”的立法或诉讼动作,进而对全球AI数据合规机制产生连锁影响;

其二,其他头部AI公司(如OpenAI、谷歌、Meta)是否会跟进类似实体书采购模式,或改用公开授权数据集与合成数据替代;

其三,这一波二手书大宗采购是否持续——如果证明确实与AI训练相关,独立书店的库存结构、绝版书定价以及图书馆馆藏保护都可能受到持续性冲击。

来源:BBC News

celebrityanime
celebrityanime
文章: 18615

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注