漫话大模型:7 家中国公司被点名「蒸馏」,他们到底偷走了什么?

Anthropic 发布报告,指控阿里、DeepSeek、月之暗面等 7 家中国 AI 公司通过转发请求、抓取推理轨迹等方式"蒸馏"Claude 能力;这背后是闭源黑盒与开源权重在蒸馏技术路线上的根本差异,值得行业关注。

一句话看懂:Anthropic 发布报告,指控阿里、DeepSeek、月之暗面等 7 家中国 AI 公司通过转发请求、抓取推理轨迹等方式”蒸馏”Claude 能力;这背后是闭源黑盒与开源权重在蒸馏技术路线上的根本差异,值得行业关注。

事件核心:发生了什么

2026 年 9 月,Anthropic 发布报告,点名阿里、DeepSeek、月之暗面、智谱、小米、商汤、MiniMax 共 7 家中国公司,指控其以多种方式蒸馏 Claude 模型能力。报告给出具体数据:阿里被指在 5 至 7 月间产生 1.5 亿次交互;DeepSeek 被指 14 天内将 1200 万次用户请求转发给 Claude;月之暗面被指把近 30 万真实用户问题直接转给 Claude 代答。目前公开信息显示,被点名公司大多未作回应,上述均为 Anthropic 单方面指控。

为什么重要

这触及大模型竞争的关键技术分叉。正规蒸馏分两条路:一是 off-policy 监督学习,用老师模型的输出做训练,见效快但有”暴露偏差”——学生训练时只见标准答案,自己生成走偏后无人纠正;二是 2025 年底兴起的 ODP(在线策略蒸馏),让学生自己生成、老师逐 token 打分,用逆向 KL 散度做密集反馈。Qwen3 技术报告显示,ODP 仅用 1800 GPU 小时就把成绩从 60% 级刷到 74.4%,而 RL 方案耗时近 10 倍。关键在于:ODP 需要老师的 logprob,而 GPT-4o、Claude 等闭源 API 早已移除或从未提供该参数,黑盒模型只能降级做 SFT。开源权重模型之间则可完整做 ODP。这解释了为何闭源厂商对”被蒸馏”格外敏感,也说明被指控偷走的能力价值可能有限。

对用户/开发者/创作者的影响

对开发者而言,选择开源权重模型做蒸馏和微调的空间明显更大,logprob 可查、分布可算;调用闭源 API 则只能做风格模仿,难以复现真正的推理分布。对使用 AI 应用的用户和创作者来说,短期内模型能力差距不会因这类指控发生剧变,但依赖闭源 API 的产品若被限制访问或加强风控,可能影响稳定性和成本。企业采购时,需重新评估”基于某闭源 API 二次训练”路线的合规风险与长期可持续性。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Anthropic 是否会公布更完整的证据或采取合同层面的限制措施;二是被点名的 7 家公司是否公开回应,以及其模型后续迭代是否出现能力波动;三是开源社区 ODP 相关工具链是否进一步成熟,推动更多团队从”偷答案”转向”请老师批改”的训练范式。

来源:juejin

celebrityanime
celebrityanime
文章: 26420

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注