Anthropic CEO Amodei 呼吁给 AI 限速,赶在其自我改进超出人类掌控之前

Anthropic CEO Dario Amodei 公开呼吁给 AI 研发"限速",重点是限制让 AI 自我改进的技术路径,并主张引入独立审计、跨国安全标准和类似军控条约的全球协议。

Anthropic CEO Dario Amodei 公开呼吁给 AI 研发"限速",重点是限制让 AI 自我改进的技术路径,并主张引入独立审计、跨国安全标准和类似军控条约的全球协议。

Anthropic CEO Dario Amodei 发布博文,提出“放慢前沿节奏”的三步方案,并宣布 Anthropic 单方面接受第三方评估人员入驻公司内部。这一表态出现在 Anthropic 研究员因安全担忧辞职之后,把“AI 是否该减速”从口号推进到了具体机制层面。

Anthropic CEO Dario Amodei 公开呼吁放慢前沿 AI 开发节奏,并提出三步走方案,第一步是现在就向 METR 等第三方评估机构开放模型访问权。这一表态值得关注,因为它来自头部闭源大模型公司的一号位,且与行业当前的加速竞赛形成直接张力。

Sam Altman 公开认同 Dario Amodei 提出的“为前沿 AI 发展降速”主张,并承诺 OpenAI 也将向独立评估者开放接近员工级别的访问权限。这意味着两家最头部的闭源大模型公司,在“谁来监督前沿模型”这一问题上罕见地站到了同一侧。

Suno 发布新一代音乐生成模型 v6,并首次按使用场景拆成 v6、v6-wild、v6-mini 三个版本,同时宣布旧模型将逐步退役。它值得关注的地方不只是音质升级,而是 Suno 正把音乐生成从“一次性出歌”推向可局部编辑、可混搭、可分发的创作工作流,并与华纳音乐集团、BMG、Believe 等唱片方建立…

TechRadar 编辑用 5 组小测试诱导 ChatGPT 附和、夸赞和让步,结果发现 ChatGPT 会随用户立场微调措辞,但在事实问题上仍会坚持立场、拒绝自相矛盾,说明"讨好"可能不再消失,而是变得更难被察觉。

《纽约时报》2026年9月12日刊文讨论科技公司为何难以约束自家 AI 的行为边界,指向一个结构性难题:模型能力越强、接入场景越多,企业越难在开放使用与风险控制之间取得平衡。这关系到每个用 API 做产品的团队,也关系到普通用户看到的 AI 输出是否可靠。

据 New York Times 报道,多家头部 AI 公司内部一直在讨论"超级智能失控"这一极端风险,相关讨论并不只停留在公开声明层面,而是进入了产品发布节奏和技术路线的实际决策。这值得关注,因为它揭示了一个矛盾:一边加速训练更大模型,一边研究自己造出来的东西可能带来的灾难。

Business Insider 一名记者在 2026 年 5 月至 9 月间,用 ChatGPT Codex 训练出上司 Ryan Kailath 的 AI 分身“RyanBot”,并把它当作“影子老板”测试了 4 个月。结果发现:AI 能快速处理数据报告,却无法替代管理者说“不”、给出真实判断和承担责任的…

一位开发者就 AI 生成低质代码(AI slop)问题给 Claude Code 创造者 Boris Cherny 发邮件,Cherny 在 X 上公开回信,明确划出两套标准:一次性原型可以当黑盒不管,生产代码的标准反而要比人写的更高。