一句话看懂:微软与 OpenAI 试图封存的一批内部文件被法院解封,其中高管自己承认用新闻内容训练 AI 是”前所未有规模的盗窃”、”对合理使用概念的彻底嘲弄”。这批自认可能直接削弱两家公司在版权诉讼中的核心抗辩。
事件核心:发生了什么
由《纽约时报》牵头的新闻机构原告方本周公开了一份解封的简易判决动议。文件显示,微软应用科学总监 Brent Hecht 在公司内部多次警告,抓取新闻用于 AI 训练是”惊人规模的盗窃”,可能是”人类历史上最大的劳动窃取”;他还指出这种做法让”合理使用”这个概念成了笑话。OpenAI 方面,ChatGPT 负责人 Nick Turley 在内部消息中称出版商将面临”生存威胁”,因为用新闻训练的商用产品可以直接替代新闻提供方。
微软内部文件还提出”末日循环”的说法:模型与整个网络的表现会同时受损。数据侧,微软记录的点击率下滑幅度在部分原告处达到 83%–93%,另一些为 51%–94%。两家公司内部也承认用户”没有理由点击”原始链接,Turley 称聊天机器人”本质上是替代性的”。此外,一名员工告知总裁 Greg Brockman 发现绕过《纽约时报》付费墙的”破解方法”时,后者回复”Ah, nice”;CEO 纳德拉则在宣誓作证时承认聊天机器人正在”从新闻网站偷走点击”。
为什么重要
合理使用是微软和 OpenAI 应对版权诉讼的主要法律防线,而原告现在拿出的不是外部推测,而是被告自己的内部判断。如果法院认定聊天机器人构成对新闻产品的市场替代,同时又能逐字输出文章片段,合理使用的抗辩空间会被显著压缩。这不只关乎赔偿金额,还关乎大模型训练数据的获取方式是否需要从”先抓后谈”转向事先授权与付费许可。
对用户/开发者/创作者的影响
对创作者和媒体而言,这批文件提供了可用于谈判的证据:流量损失有内部数据佐证,授权定价的筹码会变化。对开发者来说,依赖公开网页抓取构建 RAG 或训练数据的做法,合规风险正在从”理论问题”变成”有判例风险的问题”,未来可能更依赖明确授权的数据集或 API。对普通用户,短期体验不会变化,但如果内容授权成本上升,检索类 AI 产品的信息覆盖面和回答质量可能受影响。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是案件是否进入正式庭审,以及法院对”替代性”与”逐字输出”如何认定;二是微软与 OpenAI 是否会调整爬虫策略或加速与出版商的授权交易;三是其他司法辖区的类似诉讼是否会引用这批内部文件作为参考。


