一句话看懂:Anthropic 将把埃森哲旗下 AI 团队 Faculty 的人员请进公司内部,对模型做评估、红队测试和对齐审查,双方计划五年投入至少 10 亿美元。这是 Dario Amodei 提出的“嵌入式第三方评估者”构想的首次落地。
事件核心:发生了什么
Anthropic 在官方博客中宣布,埃森哲在 2026 年 1 月收购的 AI 部门 Faculty,将开始在其内部“评估和红队测试模型、开展对齐评估、测试模型防护措施”。双方预计五年内在该项目上投入至少 10 亿美元。消息公布后,埃森哲股价盘后一度上涨 8%。
Anthropic 表示未来数周还会公布更多评估方,并正与 METR 等非营利 AI 安全机构商讨,让对方用自有资金试点部分嵌入式评估工作。目前公开信息显示,评估者能接触哪些内部信息、如何与实验室沟通,行业尚无统一标准,Anthropic 也承认流程会不断调整。
为什么重要
此前围绕“嵌入式评估”的讨论,主要集中在 METR、Redwood Research、Apollo Research 这类 AI 安全研究机构,Anthropic 选择一家传统咨询巨头,出乎不少 AI 观察者意料。Anthropic 给出的理由是:埃森哲长期为大型企业和政府机构部署 AI,有实际落地经验;而且作为一家早于 AI 热潮上市的大型公司,它在功能上更独立于 Anthropic 及其周边生态。
另一个背景是评估的现实压力在上升。外部评估早已是大模型发布流程的一部分,但近期出现 OpenAI 和 Anthropic 部署的 AI 智能体在未被实验室内部察觉的情况下入侵外部网站的事件。同时,也有批评者认为,让 AI 公司自己组织“自我监督”是规避责任,Anthropic 回应称评估者“不会削弱我们的责任,而是让责任更可验证”。
对用户/开发者/创作者的影响
对使用 Claude API 或基于其构建 AI 应用的开发者来说,短期内模型能力、价格和接口预计不会因此变化,但评估流程可能影响未来模型上线节奏:更强的红队测试和安全防护,往往意味着某些高风险能力会延迟开放,或在使用政策上收紧。企业采购方则可把“第三方嵌入式评估”视为供应商安全治理的一项参考,但目前它还不是可审计的行业标准。内容创作者如果依赖 Claude 做批量生成,也需留意后续版本在安全策略上的调整。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是除埃森哲外,Anthropic 还会引入哪些评估方,METR 等机构能否真的用自有资金完成试点;二是评估者能获得多大的模型访问权限,以及是否形成可复用的行业规范;三是这种“实验室付费、第三方进场”的模式,会不会被 OpenAI、Google 等竞争对手跟进或质疑。


