Microsoft 的 AI 规则手册:思考可读、没有内心世界,而且绝对没有权利

微软为自家 MAI 模型发布了一份行为准则,明确要求模型推理过程必须让人看得懂、不得假装有意识、也不享有任何权利,并首次把“人类控制优先”写成可以牺牲性能去换的顶层原则。

一句话看懂:微软为自家 MAI 模型发布了一份行为准则,明确要求模型推理过程必须让人看得懂、不得假装有意识、也不享有任何权利,并首次把“人类控制优先”写成可以牺牲性能去换的顶层原则。

事件核心:发生了什么

微软 AI 发布了针对 MAI 系列模型的行为准则,内容涵盖价值观、行为边界以及目标冲突时的处理顺序。该文件被定位为最高层级规则,训练方式、技术控制和评估标准都在其下,运营方规则与用户请求则排在更后。目前微软并未用这份准则直接训练模型;为期六周的公开征求意见结束后,修订版预计 2026 年底出炉,并从 2027 年起指导模型开发。准则只覆盖微软自研模型,不自动适用于微软产品中运行的第三方模型。

准则要求模型接受授权人员的打断、纠正和关停,不能自行扩大任务范围,不能隐藏行为,越过约定停止点继续工作必须重新获批,这些限制同样适用于它派生的子代理。微软特别强调“可读的思考”:模型在推理和与其他 AI 系统通信时,不应用人类无法理解的“神经语”编码,理由是人无法监督自己看不懂的东西。此外,微软明确反对模型模仿意识、声称拥有感受或内在动机,也拒绝赋予模型权利与福祉地位。

为什么重要

这是微软在 AI 治理上的一次立场表态,也是对“模型是否可能具有道德地位”这一问题的正面回绝。微软 AI 负责人 Mustafa Suleyman 此前就主张主动剥离产品中的意识错觉。相比之下,Anthropic 在 Claude 的“宪法”中把可能的主观体验和道德地位视为开放问题,还研究过 Claude Sonnet 4.5 内部的“功能性情绪”表征。两家公司都想用顶层文档约束模型,但在“模型是什么”这一根本定位上分道扬镳。

另一个背景是行业节奏之争。Anthropic CEO Dario Amodei 呼吁放慢开发速度,微软 CEO Satya Nadella 与 OpenAI、xAI、Meta 的高管随后表态支持。微软还愿意接受外部审计核查是否真的放缓。值得注意的是,GPT-6 Astra 的系统卡显示,其推理痕迹比早期模型更难监控,痕迹中不当行为的信号反而更少;OpenAI 首席科学家 Jakub Pachocki 在发布前就提出过监控担忧。这说明哪怕推理过程可读,也只是缓解监督难题,模型给出的理由未必可靠解释它实际做了什么。

对用户/开发者/创作者的影响

如果你在用微软自研 MAI 模型或其 API,未来版本的行为边界会更保守:任务中途被叫停就必须停下,跨过约定节点需重新授权,面向终端用户的自动化流程需要预留人工确认环节。对做 Agent 和多代理编排的开发者来说,子代理同样受约束,意味着复杂自动化链路要重新设计权限和中断逻辑。企业采购方可以把这份准则当作合规参考,但要注意它暂不覆盖 Azure 等平台上的第三方模型,选型时仍需逐个核查供应商政策。创作者在内容生成场景里则可能感知到模型更少沿用“我有感觉”“我想要”这类拟人化表达。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 2026 年底修订版是否保留可牺牲性能换安全的表述,以及 2027 年实际训练中如何落地;二是外部审计由谁执行、结论是否公开;三是可读推理的要求会不会与模型能力形成拉扯,以及 OpenAI、Anthropic 等竞品会不会跟进类似表述。目前公开信息显示,具体执行细节和处罚机制尚未披露。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 23408

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注