微软总监:AI抓取数据是“人类历史上最大的劳动力盗窃

《纽约时报》诉 OpenAI 和微软版权案中,一批内部文件被引述,显示两家公司高管私下承认 AI 抓取内容是对创作者的“史上最大劳动力盗窃”,并视 ChatGPT 为出版商的“生存威胁”。这些表态可能削弱 OpenAI 的“合理使用”抗辩。

一句话看懂:《纽约时报》诉 OpenAI 和微软版权案中,一批内部文件被引述,显示两家公司高管私下承认 AI 抓取内容是对创作者的“史上最大劳动力盗窃”,并视 ChatGPT 为出版商的“生存威胁”。这些表态可能削弱 OpenAI 的“合理使用”抗辩。

事件核心:发生了什么

《纽约时报》自 2023 年底起诉 OpenAI 和微软版权侵权以来,案件已持续近三年。近期,纽时法律团队提交法律简报并请求法院作出简易判决,其中引用了两家公司高管的内部备忘录和证词。

据 404 Media 报道,微软应用科学总监 Brent Hecht 在 2023 年 1 月的内部备忘录中称,全球数百万人很快会认为大模型“吸走”他们的作品是“空前规模的盗窃”,并直接称为“人类历史上最大的劳动力盗窃”。另一份微软文件写道,几乎没有人希望自己创作的内容被这样使用,也未因此获得补偿。

微软自身数据还显示,相比 Bing 搜索,Copilot 使《纽约时报》的点击率最多下降 93%。Hecht 在备忘录中称这是“末日循环”,会同时损害模型性能和整个网络生态。

OpenAI 方面,ChatGPT 负责人 Nick Turley 在内部沟通中称 ChatGPT 对出版商是“生存威胁”,因为其功能“基本可替代”且会随能力提升越来越可替代。另一名 OpenAI 工程师作证说,“无论我们把链接展示得多显眼,用户都不会点击”。研究员 Nick Ryder 还曾向总裁 Greg Brockman 提及绕过《纽约时报》付费墙的“小技巧”,后者回复“ah nice”。

为什么重要

AI 公司通常以“合理使用”作为抓取网络数据训练模型的核心法律依据。美国法律判断合理使用需综合考量使用目的、作品性质、使用比例,以及对原作品潜在市场的影响。而纽时简报引用的内部文件,恰好指向第四项——两家公司高层本身已意识到 AI 抓取对内容方市场可能造成实质冲击。

微软 CEO 萨蒂亚·纳德拉在今年早些时候的证词中表示,任何付费墙内容都应先获得授权才能用于训练,如果早知 OpenAI 抓取了付费墙后的信息,微软会要求其重新训练模型。目前公开信息显示,这些文件仍处于密封或删节状态,但若被法院采纳,可能对 OpenAI 的合理使用抗辩构成压力。

对用户/开发者/创作者的影响

对内容创作者和出版商而言,这批文件提供了 AI 抓取造成流量与收入损失的内部证据,可能推动更多媒体选择诉讼或要求授权付费。对开发者,若法院收紧合理使用边界,依赖公开网页数据训练或微调模型的成本与合规门槛将上升,API 和数据集供应商可能被迫提供更明确的来源授权。对普通用户,短期内工具使用体验变化有限,但长期看,如果内容授权成本传导至产品端,部分 AI 应用的免费额度、价格或内容覆盖范围可能调整。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是法院是否采纳这些内部文件作为证据,以及简易判决请求是否获批。二是 OpenAI 和微软是否会调整数据授权策略,例如扩大与出版商的付费协议。三是其他内容方是否会援引类似文件发起新的诉讼或授权谈判。

来源:Hacker News

celebrityanime
celebrityanime
文章: 24494

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注