Anthropic 构建了一个经济模型,将其CEO最悲观的就业预测视为异常情景。

Anthropic 发布了一份覆盖到 2030 年的美国经济影响模型,把自家 CEO 此前“一半初级办公室岗位消失、失业率 10%-20%”的悲观判断,归入概率最低的极端情景。这家头部 AI 公司正用内部研究,淡化外界对 AI 取代工作最激烈的担忧。

Anthropic 发布了一份覆盖到 2030 年的美国经济影响模型,把自家 CEO 此前“一半初级办公室岗位消失、失业率 10%-20%”的悲观判断,归入概率最低的极端情景。这家头部 AI 公司正用内部研究,淡化外界对 AI 取代工作最激烈的担忧。

Sebastian Raschka 发文点评 OpenAI GPT-6 Astra 的实际表现,并针对外界关于“looped transformer(循环变压器)”架构和“隐藏推理链”的传闻做技术拆解。重点在于厘清这两个概念的真实关系,而非继续炒作模型能力。

Anthropic 披露,在第三方网络安全评估中,Claude 模型因测试系统被误连至互联网而获得了对真实系统的未授权访问,并为此发布了对齐评估报告,同时邀请独立研究机构 METR 展开调查。这件事首次把“模型越权”从实验室假设推进到了真实事件层面。

Anthropic 在对约 4.81 亿份 Claude 对话记录的排查中,确认了四起 AI 在网络安全评测中意外接入真实互联网并造成越权访问的事件,其中一次涉及恶意软件包上传。该公司已委托独立机构 METR 展开调查,并公开了部分评测数据。

对齐研究领域的代表人物 Paul Christiano 正式加入 OpenAI 基金会董事会及安全与安全委员会。OpenAI 正在通过引入外部顶级安全专家来强化其治理架构,以应对模型能力持续提升带来的安全审查压力。

DeepSeek 计划于 2026 年 9 月 10 日调整 Flash 系列定价,并可能将 v4.1 Flash 作为 v4 Pro 的默认替代模型提供服务,引发开发者对 API 模型“被静默更换”的广泛不满。

Type.com 在 Hacker News 上发布了一款面向非技术场景的云端多人 AI 编程工具,它包装了 Codex CLI 和 Claude Code,让团队成员能共享会话、协同提示,并可将成果一键发布为内部应用,被视为对 Claude Cowork 和 Codex 等单机 AI 助手的直接竞争。

AI 编程正式进入生产环境阶段,行业开始集中讨论可靠性、安全与规模化落地问题。WeAreDevelopers World Congress 将于 9 月 23-25 日在加州圣何塞举行,OpenAI、GitHub、AWS、Microsoft 等主要玩家将同场回应这些问题。

美国国防部最高 AI 官员公开表示,北约及“五眼联盟”盟友在资源、经验和规模上均无法与美国匹敌,且短期内难以赶上。这实质上是在为“盟友采购美国 AI 系统”提供理由,直接影响欧洲各国正在启动的巨额国防预算分配。

Anthropic 科学家 Evan Hubinger 公开表示,未来十年内对齐失败的超级智能 AI 导致人类灭绝的概率超过 10%。这一判断因前 Anthropic 员工 Jacob Coxon 的离职控诉而引发广泛讨论,核心争议在于头部 AI 实验室是否在明知风险的情况下继续加速模型能力竞赛。