Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击

Anthropic 发布报告,指控阿里巴巴、月之暗面(Moonshot AI)和 DeepSeek 等中国 AI 公司对 Claude 发起大规模“蒸馏攻击”,试图套取模型推理过程来训练自家模型。这是目前公开披露的规模最大的一类模型能力窃取指控,涉及近 2 亿次交互。

一句话看懂:Anthropic 发布报告,指控阿里巴巴、月之暗面(Moonshot AI)和 DeepSeek 等中国 AI 公司对 Claude 发起大规模“蒸馏攻击”,试图套取模型推理过程来训练自家模型。这是目前公开披露的规模最大的一类模型能力窃取指控,涉及近 2 亿次交互。

事件核心:发生了什么

Anthropic 于周四发布报告称,过去几个月内,有未授权机构用越来越复杂的手法绕过其防御机制,批量提取 Claude 的能力。被针对的能力包括智能体(agentic)与工具调用、编程与数据分析、逻辑推理等核心方向。Anthropic 共观测到约 2 亿次与蒸馏攻击相关的交互,归因于五个独立行动。

规模最大的一起来自被指为阿里巴巴的行动:2026 年 5 月至 7 月间约 1.51 亿次交互,峰值接近每天 300 万次,分散在 3500 个账号上,但因共用同一固定提示词来提取思维链,Anthropic 判断其服务于 Qwen 系列模型的训练数据生产。另一起被归因于月之暗面(Kimi 的开发商),在 10 天内通过约 5000 个账号路由了近 30 万次请求,主要针对 Opus 模型;报告中还提到一次请求要求 Claude 分析监控录像,判断对象是否“行为异常”。蒸馏攻击的基本逻辑是套取模型回答中的思维链,再用监督微调训练更小的模型,从而以更低成本获得接近的能力。

为什么重要

这类指控触及大模型竞争的核心矛盾:前沿模型的领先优势有多少能靠“提取”而非自研获得。Anthropic 向来不向用户开放内部思维链,只展示“摘要式思考”,但报告称攻击者找到了特定技巧诱使模型直接吐出推理轨迹,例如把查询包装成翻译请求。这既说明防御存在可被绕过的空间,也意味着闭源厂商与开源阵营之间的能力差距可能被系统性压缩。Anthropic 今年 2 月已就蒸馏攻击发声,OpenAI 此前也报告过类似活动并直接指向 DeepSeek,但此次披露的规模和攻击性都更高。

对用户/开发者/创作者的影响

对普通用户,短期内使用体验不会直接改变,但前沿模型厂商可能进一步收紧思维链、工具调用等高价值能力的输出,API 调用中的行为审计和限流或更严格。对开发者,若所在团队依赖 Claude 的编程或推理能力做产品,需要留意未来 API 政策、用量监测和合规条款的变化,避免账号因异常调用模式被风控。对企业采购方,供应商对“模型能力来源”的合规审查可能成为新的尽调项。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是被指控方是否回应、是否提供反证,目前公开信息仅来自 Anthropic 单方报告;二是 Anthropic 会否据此升级账号风控或收紧思维链相关输出,进而影响正常 API 用户;三是监管层面会否把“模型蒸馏”纳入出口管制或数据合规框架,这将直接影响跨境 AI 服务的可用性。

来源:TechCrunch:AI(RSS)

celebrityanime
celebrityanime
文章: 22757

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注