AI 教父力挺一项新的监督计划,从内部追踪 OpenAI 和 Anthropic 的 AI 风险

AI 教父 Geoffrey Hinton 等数十位业内人士联名发布公开信,要求 OpenAI、Anthropic 一旦引入第三方“嵌入式评估员”,就必须给予其真正的独立性和信息访问权。这封信用来回应两家公司此前主动表态欢迎外部监督,但监督落地需要满足哪些硬性条件,正是争论焦点。

一句话看懂:AI 教父 Geoffrey Hinton 等数十位业内人士联名发布公开信,要求 OpenAI、Anthropic 一旦引入第三方“嵌入式评估员”,就必须给予其真正的独立性和信息访问权。这封信用来回应两家公司此前主动表态欢迎外部监督,但监督落地需要满足哪些硬性条件,正是争论焦点。

事件核心:发生了什么

据 Business Insider 报道,2026 年 9 月 18 日,AI Evaluator Forum(AI 评估者论坛)牵头发布公开信,提出 AI 实验室配合第三方评估的“最低条件”。签署者包括被称为“AI 教父”的 Geoffrey Hinton 和图灵奖得主 Stuart Russell 等数十位业内人士。论坛成员涵盖 METR、由前 OpenAI 员工 Miles Brundage 领导的 AVERI 等评估机构。

这封公开信直接回应了 Anthropic CEO Dario Amodei 和 OpenAI CEO Sam Altman 的表态——两人此前承诺欢迎第三方评估员进入公司内部,并在员工级别开放信息访问。公开信的核心诉求很明确:评估员必须保持科学客观、透明、独立,并具备免受被评估公司干扰的保护机制;应能与公司董事会等监督机构“不受过滤地沟通”,也可公开评估结果;同时应获得与公司内部评估人员同等的系统、数据、工具和物理空间访问权限。信中特别强调,每个实验室应引入不同视角和专业领域,涵盖生物科学风险和“失控”风险等类型。

为什么重要

过去几年,AI 安全评估多由外部机构在模型发布后进行,数据、算力和内部测试权限有限。此次讨论的核心变化是“嵌入式评估”——评估员进入实验室内部,接触尚未公开的模型和训练流程。这意味着监督从“事后抽查”转向“过程跟踪”,对前沿大模型的训练、推理和部署环节都可能产生影响。

目前公开信息显示,这封公开信更像一份谈判条件清单,而非已经达成的监管规则。它把争论从“要不要接受监督”推进到“监督要有多少权限”。对行业来说,如果这些条件被部分采纳,闭源实验室的信息壁垒会被撬开一条缝;如果不被采纳,公开信则可能成为后续监管施压的依据。微软 CEO Satya Nadella 本周也表示欢迎“嵌入式评估员”思路,说明这已不只是安全圈的议题。

对用户/开发者/创作者的影响

对普通用户和开发者而言,这一动向短期不会改变 API 价格或模型能力,但会影响模型更新节奏和合规披露方式。若第三方评估成为常态,前沿模型在上线前可能增加安全审查环节,部分功能或版本的发布周期被拉长。开发者调用 GPT、Claude 等模型时,或许会看到更详细的安全说明或能力边界文档。对创作者和企业采购者来说,评估结果的公开程度提高,有助于判断某个 AI 应用或大模型是否适合用于敏感场景。需要强调的是,目前公开信息显示这仍是倡议阶段,尚无公司正式签署或承诺执行细则。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 OpenAI 和 Anthropic 是否会就公开信中的具体条件作出正式回应,尤其是是否允许评估员直接接触董事会和公开评估结果。二是 METR、AVERI 等机构能否拿到实际的员工级访问权限,这将检验“嵌入式评估”是真实落地还是公关姿态。三是监管层面是否会将此类条件写入正式规则,进而影响模型上线节奏和开源、闭源路线的竞争格局。

来源:Business Insider

celebrityanime
celebrityanime
文章: 24280

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注