AI 实验室面临数据信任问题,现有政策尚未解决

Anthropic 因保留 30 天使用日志,导致英伟达、Booz Allen Hamilton、Palantir 等企业限制其旗舰模型 Fable 用于敏感业务;这暴露了 AI 实验室的数据政策与企业知识产权保护之间的深层矛盾。

一句话看懂:Anthropic 因保留 30 天使用日志,导致英伟达、Booz Allen Hamilton、Palantir 等企业限制其旗舰模型 Fable 用于敏感业务;这暴露了 AI 实验室的数据政策与企业知识产权保护之间的深层矛盾。

事件核心:发生了什么

据 The Information 报道,Anthropic 在 6 月调整政策,宣布保留 Fable 模型的使用日志 30 天,以防御“复杂和新颖的攻击”。此举引发企业客户反弹:英伟达仅将 Fable 用于开源项目等低敏感任务,内部 AI 供应链监控则改用自研 Nemotron 模型;Booz Allen Hamilton 禁止员工在专有网络安全软件中使用 Fable;Palantir 则阻止客户通过其平台部署 Fable,直到 Anthropic 提供不可撤销的零数据保留保证。值得注意的是,英伟达既是 Anthropic 的投资方,也是其硬件供应商。OpenAI 在 8 月已允许 GPT-5.6 Cyber 客户将安全日志存储在自己的服务器上,Anthropic 随后跟进,将于今年秋季向部分客户推出类似方案。

为什么重要

这不仅是单一公司的信任危机,而是整个大模型商业化面临的共同问题。企业客户的核心资产是代码、业务流程和专有数据,一旦这些信息可能被用于模型训练或推理优化,采购决策就会变得极为谨慎。零数据保留本身也并非万无一失:OpenAI 和 Anthropic 仍会收集元数据和技术使用数据,用于自动化分类和安全分析。OpenAI 前联合创始人 John Schulman 指出,从直接预训练到蒸馏,再到利用“用户轨迹”构建强化学习任务,多种路径都可能提取客户 IP,而“去标识化很弱”,少量比特即可追溯到用户。AI 研究员 Sarah Hooker 也警告,合成数据技术可以生成分布等价数据,企业如果不用自己的 IP 构建智能能力,最终可能被前沿实验室侵入垂直领域。

对用户/开发者/创作者的影响

对于依赖闭源大模型 API 的开发者与企业,选择模型时需要更仔细地审视数据保留条款、元数据收集范围以及是否支持本地化日志存储。涉及核心代码、敏感业务逻辑或专有数据的场景,可能需要在闭源 API、私有部署模型与自研模型之间重新权衡。开源模型和自托管方案会因此获得更多关注。对创作者而言,如果使用 AI 工具处理未公开的创意或商业内容,同样需要关注平台的数据使用政策,避免作品在不知情的情况下成为训练素材。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Anthropic 秋季推出的零数据保留方案能否覆盖更多客户,以及是否真正满足 Palantir 要求的“不可撤销”保证;二是 OpenAI、Anthropic 等实验室是否会公开更细粒度的元数据收集说明,以缓解企业疑虑;三是英伟达等公司自研模型的替代效应是否扩大,进而影响前沿模型在企业市场的份额。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 23701

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注