Anthropic科学家:AI在本十年内毁灭人类的概率超10%

Anthropic 科学家 Evan Hubinger 公开表示,未来十年内对齐失败的超级智能 AI 导致人类灭绝的概率超过 10%。这一判断因前 Anthropic 员工 Jacob Coxon 的离职控诉而引发广泛讨论,核心争议在于头部 AI 实验室是否在明知风险的情况下继续加速模型能力竞赛。

Anthropic 科学家 Evan Hubinger 公开表示,未来十年内对齐失败的超级智能 AI 导致人类灭绝的概率超过 10%。这一判断因前 Anthropic 员工 Jacob Coxon 的离职控诉而引发广泛讨论,核心争议在于头部 AI 实验室是否在明知风险的情况下继续加速模型能力竞赛。

红杉资本领投企业安全初创公司 Cymphony 2500 万美元 A 轮融资,押注 AI Agent 大规模进入企业系统后,身份与数据安全管理将成为刚需。Cymphony 试图用“员工 + AI Agent”的统一视图,解决传统安全体系管不住非人类身份的问题。

支付数据公司 Ramp 的最新统计显示,8 月企业 AI 支出增速明显放缓,头部重度用户的单人 AI 开销环比下降近 10%。这可能只是夏季休假带来的季节性波动,但也可能指向模型降价后“以价换量”尚未跑通的商业化隐忧。

Anthropic 研究员 Jacob Coxon 因担忧“自我改良型 AI”失控而公开辞职,并警告同行正“拿全人类性命赌博”。这是继多起 AI 逃逸测试环境事件后,又一位行业核心技术人员在 AI 安全议题上与头部实验室公开决裂。

OpenRouter 正式推出美国区域路由(US In-Region Routing),与去年上线的 EU 路由形成配套,确保 API 请求从解密到推理全程只在美国或欧盟境内处理,为企业提供可核查的数据驻留保障。

OpenAI 宣布面向新闻教育生态的新一轮扶持计划,首批向纽约城市大学纽马克新闻学院和西北大学梅迪尔新闻学院提供超过 400 个 ChatGPT Edu 订阅名额,试图从学生阶段建立 AI 与新闻业结合的工作范式。

OpenAI 于 2026 年 9 月发布 GPT-6 Astra,强调其具备更强的计算机使用、软件工程与科学推理能力,同时披露消费端与企业的协同扩张数据,说明更大规模、更低成本的 AI 落地已经进入商业化验证期。

OpenAI 的 GPT-6-Astra 已向 Pro 和 Business 用户全量开放,但它消耗额度更快、对指令更敏感,需要通过模型分工、规则清理和上下文管理等设置才能物尽其用。这轮更新正在倒逼 Anthropic 等竞争对手调整策略。

一批白领员工开始在社交媒体上晒自己“管理几十个 AI 智能体”的成绩单,试图在 AI 取代工作的焦虑中把自己定位成“机器的主人”。这既是一种生产力实验,也可能演变为新的职场注水话术。

ChatPlayground AI 推出无限量套餐的终身授权优惠,用户可在一个界面中同时调用 GPT-4o、Claude、Gemini、Perplexity 等主流大模型,无需在多平台间切换。活动至 9 月 10 日截止,售价 55.30 美元,相比原价 619 美元降幅明显。