Anthropic 与 Accenture 合作开展嵌入式独立评估,双方各投入至少 10 亿美元

Anthropic 与埃森哲(Accenture)达成合作,由后者旗下的 AI 业务部门 Faculty 派人“嵌入”Anthropic 内部,独立评估其前沿模型的安全与对齐情况。双方计划未来五年各投入至少 10 亿美元。这是前沿大模型公司首次把独立评估者放进自己内部,而不是交给外部机构事后检查。

一句话看懂:Anthropic 与埃森哲(Accenture)达成合作,由后者旗下的 AI 业务部门 Faculty 派人“嵌入”Anthropic 内部,独立评估其前沿模型的安全与对齐情况。双方计划未来五年各投入至少 10 亿美元。这是前沿大模型公司首次把独立评估者放进自己内部,而不是交给外部机构事后检查。

事件核心:发生了什么

根据 Anthropic 2026 年 9 月 18 日发布的公告,这项合作的核心是“嵌入式评估”:评估人员不再像传统外部评估机构那样只拿到公开版本或有限接口,而是以接近正式员工的身份进入 Anthropic,能在模型训练过程中观察其成形,追踪影响模型构建和部署的决策,并直接与员工沟通。评估内容具体包括对模型进行红队测试(red-teaming)、开展对齐评估、测试模型的安全防护措施。

合作由埃森哲旗下专注 AI 的业务部门 Faculty 牵头。Anthropic 和埃森哲各自预计在未来五年投入至少 10 亿美元建设这方面的能力。Anthropic 将直接出资支持埃森哲的工作,同时也在与 METR 等非营利评估机构沟通,用这些机构自己的资金试点嵌入式评估的部分环节。该合作是非排他性的:Anthropic 还将在未来几周公布其他评估方,埃森哲也会以类似身份服务其他 AI 开发商。

为什么重要

前沿模型的训练和部署过程长期不透明,外部评估者通常只能看到成品模型,难以判断一家公司是否真的在兑现安全承诺。嵌入式评估试图改变这一点:评估者能看到模型在训练中如何演变、哪些决策影响了它的行为,从而发现外部视角容易忽略的盲区。Anthropic 明确表示,这不会减轻公司自身对模型安全的责任,但能让这种责任“更可验证”。

另一个关键点是资金模式。目前业界既没有嵌入式评估者应获得哪些信息的标准,也没有成熟的独立评估筹资机制。Anthropic 在 2026 年 6 月提出的“Advanced AI Framework”中呼吁,长期资金应来自行业共同池或政府来源。在两种机制都不存在的情况下,它选择先由自己直接出钱,这在客观上会引发“谁出钱、评估独立性如何保障”的讨论。

对用户/开发者/创作者的影响

对普通用户和依赖 Claude API 的开发者来说,短期内产品能力和价格不会因这项合作直接变化,但模型在安全策略、拒答边界、内容过滤上的调整,可能会更多来自嵌入式评估发现的问题。对企业采购方而言,一个可被第三方独立核验的安全流程,可能成为合规审查时的加分项——尤其是在金融、医疗、政务等对 AI 风险敏感的行业。对做 AI 应用和内容创作的团队,这意味着未来模型的行为规范可能更透明,减少因安全策略突变带来的适配成本。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是标准缺位如何填补:嵌入式评估者能看到什么、如何报告发现,目前仍无行业规范,Anthropic 与 Faculty 的实际操作可能成为事实参考。二是资金独立性:Anthropic 直接为评估方出资,如何避免“自证清白”的质疑,是这套机制能否被外界信任的关键。三是竞品是否跟进:该合作非排他,如果其他前沿实验室也开始引入嵌入式评估,行业评估生态可能从零散走向共享标准。目前公开信息显示,具体运营细节仍在制定中。

来源:Anthropic:Newsroom(网页)

celebrityanime
celebrityanime
文章: 24360

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注