一句话看懂:微软 AI CEO Mustafa Suleyman 在 The Verge 播客中称 AI 风险真实存在,并批评 Anthropic 的“模型福利”哲学让安全讨论跑偏。微软同期发布 37 页《人本主义 AI 行为准则》,主张先“可控”再谈“对齐”。
事件核心:发生了什么
2026 年 9 月 17 日,微软 AI CEO Mustafa Suleyman 做客 The Verge 的 Decoder 播客,围绕 AI 安全与监管展开讨论。他提出“遏制”先于“对齐”:模型必须先被限制能动性、避免越出沙箱和奖励黑客,才谈得上与人类价值对齐。
同期微软发布 37 页《人本主义 AI 行为准则》,阐述其 AI 开发原则和对 AI 意识等争议问题的立场。Suleyman 还发表配套文章,批评 Anthropic 围绕 AI 意识构建的“模型福利”理念,认为这种思路把行业带向了危险方向。他以 GPT-3 到 GPT-6 再到 GPT-9 的算力跃迁作类比,强调预训练加强化学习的规模增长是经验事实而非炒作。
为什么重要
这是头部厂商在 AI 安全叙事上的正面对撞。Anthropic 长期以安全与对齐为核心卖点,Claude 系列在开发者中积累了口碑;微软则试图用“可控优先”的框架争夺监管话语权。目前公开信息显示,双方的差异不只是技术路线,更涉及谁来定义“安全”的标准。对正在评估闭源大模型采购的企业和开发者来说,这会影响其对模型可审计性和合规风险的判断。
对用户/开发者/创作者的影响
如果“遏制优先”成为主流合规思路,API 层面可能继续收紧对模型自主动作、工具调用和长时间推理任务的权限,开发者在构建 AI 应用时需要为沙箱限制和人工确认流程预留空间。创作者使用的图像生成、文本生成工具短期内体验变化有限,但涉及模型自我报告、情绪表达之类的功能,可能因厂商哲学分歧而出现产品差异。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是微软是否把准则落成具体的 API 权限和产品策略,而不只是文档表态;二是 Anthropic 是否公开回应“模型福利”争议,或调整相关表述;三是监管机构在制定 AI 规则时,会优先引用哪一方的安全框架。
来源:The Verge


