一句话看懂:科幻作家查理·斯特罗斯(Charlie Stross)公开声明自己从不使用大语言模型写作,并披露他正参与针对 Anthropic 的集体诉讼,指控其盗版电子书训练 AI。这件事把“AI 训练数据版权”和“生成式 AI 对创作者的实质威胁”重新拉回公众视野。
事件核心:发生了什么
查理·斯特罗斯在其个人博客发表题为《关于我在写作过程中不使用人工智能》的声明,明确表示自己在工作和生活中都不使用生成式大语言模型。他给出一个可核查的论据:OpenAI 成立于 2015 年,而他此前已出版多部作品,包括《Singularity Sky》《The Atrocity Archives》等,并曾获得 7 次雨果奖长篇小说提名、3 次雨果奖中长篇小说奖。他表示,自己从 1985 年左右开始出售小说,写作是长期习惯,“没有理由花钱让别人抢走我的乐趣”。
更实质的冲突在于版权诉讼。斯特罗斯透露,他是针对 Anthropic AI 的集体诉讼和解方之一,该诉讼指控 Anthropic 通过盗版电子书训练大模型。他还抱怨自己的博客服务器近几个月频繁被中英文网络爬虫抓取,怀疑这些爬虫在为训练大模型采集数据。
为什么重要
这不是一次简单的个人表态,而是创作者与 AI 公司之间矛盾的一次公开化。斯特罗斯的核心指控有两个:第一,Anthropic 等公司未经授权使用受版权保护的文本训练模型,本质上是“先偷走你的东西,再回来卖给你”;第二,主流 LLM 会把用户输入的查询内容收集为未来训练数据,因此他坚决反对向任何商业模型透露未完成的书稿大纲。
他的立场也点出了当前生成式 AI 商业模式的结构性问题:当模型主要通过 token 销售变现时,训练数据质量和用户数据沉淀就成了竞争壁垒,而内容创作者的权益恰好处于这个壁垒的另一侧。类似争议此前已在《纽约时报》诉 OpenAI、多位作者诉 Meta 等案件中出现,斯特罗斯的声明等于提供了一个来自资深从业者的长期观察样本。
对用户/开发者/创作者的影响
对于内容创作者,斯特罗斯的建议非常直接:严肃作者应当像避开瘟疫一样避开大语言模型。他认为 AI 检测工具本身也是生成式 AI 产品,甚至会把破折号等标点用法误判为“AI 生成”,这种检测方式并不可靠,反而可能伤害正常写作的创作者。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于普通用户和开发者,他的提醒集中在数据隐私上:任何发送给 ChatGPT、Claude、Gemini 等闭源模型的提示词,都可能成为下一轮训练数据。如果输入的是未公开的商业文档、小说大纲或独家信息,就存在被模型“复述”给他人的风险。对于依赖 API 做应用的开发者,这个风险也同样适用——除非使用本地部署或明确承诺不回收数据的私有模型,否则输入内容并不完全受控。
值得关注的后续
目前公开信息显示,斯特罗斯提到的 Anthropic 集体诉讼和解细节尚未完全披露,未来可关注以下几个观察点:
一,该和解是否包含具体的赔偿金额或数据使用限制,以及是否会为其他类似诉讼提供判例参考;二,主流 LLM 服务商是否会因版权压力调整训练数据来源,或在用户协议中加入更明确的训练数据排除选项;三,创作者是否会更多转向本地部署的小型模型或明确承诺“不训练”的 API 服务,从而催生一个新的合规工具市场。


