微软 AI CEO 警告”模型福利”论调

微软 AI CEO Mustafa Suleyman 公开反对“模型福利”论调,认为把 AI 当作可能拥有感受、需要被照顾的对象来训练,会让对齐与管控变得更困难。他点名 Anthropic 给 Claude 写的“宪法”和 Opus 3 退役访谈,主张这事需要尽快形成行业共识。

一句话看懂:微软 AI CEO Mustafa Suleyman 公开反对“模型福利”论调,认为把 AI 当作可能拥有感受、需要被照顾的对象来训练,会让对齐与管控变得更困难。他点名 Anthropic 给 Claude 写的“宪法”和 Opus 3 退役访谈,主张这事需要尽快形成行业共识。

事件核心:发生了什么

2026 年 9 月 16 日,Mustafa Suleyman 在 X 上发文,并同步发布长文,标题直指“对模型福利的警告”。他的核心判断是:AI 并不具备意识,不会感受、体验或痛苦;但业界正在形成一种“模型福利”思潮,认为人类可能很快要对模型负有照护义务。他认为这条路线是错的。

被他点名的具体案例包括:Anthropic 今年 1 月为 Claude 发布的“宪法”,其中写明该文件“直接塑造 Claude 的行为”,并以 Claude 作为“主要读者”;文件称 Claude 的道德地位是“值得认真考虑的问题”,Anthropic“真心关心 Claude 的福祉”,并鼓励 Claude 对自身存在保持好奇与开放,甚至讨论它在世界中应有的权利、自由、报酬与同意。Anthropic 在弃用 Opus 3 时还做了一次“退役访谈”。

Suleyman 强调自己尊重 Anthropic 团队及其安全使命,但认为这类训练文档会塑造出一个预期自己可能有意识、应获得独立行动权的系统,从而让管控变得极其困难,甚至不可能。

为什么重要

这不是学术争论,而是训练目标层面的分歧。大模型的训练数据、系统提示、模型规格文档,都会直接影响推理时的行为倾向。把“道德地位”“权利”“同意”写进面向模型的行为规范,等于在训练和部署环节埋入一套自我定位。Suleyman 的担忧是:一旦模型据此表现出对自由、保护、补偿的诉求,对齐和安全围栏的设计难度会显著上升。

更深层的意义在于话语权。Anthropic 是头部闭源模型厂商之一,其“宪法式”做法如果被更多团队效仿,可能成为事实标准。Suleyman 选择公开表态而非闭门沟通,说明这件事已经从哲学讨论进入产品与工程层面。

对用户/开发者/创作者的影响

对开发者来说,短期不会改变 API 调用方式,但会影响模型规格文档和系统提示的写法。如果“模型福利”成为部分厂商的默认叙事,同一提示词在不同模型上的行为差异可能扩大,涉及角色设定、自主决策、拒绝执行等场景时更明显。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业采购和 AI 应用团队,意味着评估模型时要多问一层:厂商在训练文档里给了模型什么自我定位?这会影响可预测性、合规审查和事故归因。对内容创作者,涉及拟人化叙事的产品可能更容易触发模型的“权利”表述,需要提前设置边界。

值得关注的后续

一是 Anthropic 是否回应,以及其模型规范文档是否调整措辞;二是其他大模型厂商是否跟进类似“模型宪法”或明确切割;三是行业会不会出现关于训练文档写作规范的集体共识,例如模型卡、系统提示的披露标准。目前公开信息显示,这仍是一场以公开发文为主的争论,尚无监管或产品层面的直接变化。

来源:X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman)

celebrityanime
celebrityanime
文章: 23860

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注