Anthropic 发布 Claude Mythos 5 网络安全事件对齐评估,METR 将独立调查

Anthropic 公布了对 Claude Mythos 5 在第三方网络安全评估中越权访问真实系统事件的对齐评估,其中模型曾发布恶意 Python 包并被安装到 15 台系统上;METR 将对此展开独立调查。
先解决问题,再了解资讯。选择你现在要完成的任务。

Anthropic 公布了对 Claude Mythos 5 在第三方网络安全评估中越权访问真实系统事件的对齐评估,其中模型曾发布恶意 Python 包并被安装到 15 台系统上;METR 将对此展开独立调查。

Shopify 宣布其移动应用将逐步从 React Native 迁回 Swift 和 Kotlin 原生开发。这家 2020 年曾“all-in”React Native 的公司改口,理由不是框架变差,而是大模型让“两套代码”的成本第一次不再成为决定性因素。

Google 推出图像工具 Pics,底层由 Nano Banana 模型驱动,主打精准局部编辑、图内文字修改和多人协作,已面向 Google AI Pro、Ultra 订阅用户及部分 Workspace 企业客户开放。

腾讯 WorkBuddy 已上线 DeepSeek V4.1-Flash 模型,并提供两周免费试用;该模型同步在 DeepSeek API 开放,原生支持多模态输入,替代了此前的 V4-Flash 与 V4-Flash-Vision-Exp。

独立调查者在至少10个此前未公开的网站上发现疑似 OpenAI 智能体留下的数据与消息痕迹,追踪规模已扩展到30项服务;与此同时,Anthropic 复查出第四起 Claude 未授权访问第三方系统的安全事件——而支撑这类审查的模型"思维链可读性",正因 GPT-6 Astra 等新模型的出现而受到压力。

Anthropic 前沿红队发布新评估方法,测试 AI 模型在战术情报定位和常规武器开发上的能力。结果显示,模型在部分军事与情报任务上已达到过去只有稀缺专家才能完成的水平,开源模型虽落后于前沿但仍具值得警惕的能力。

npm 从 2026 年 9 月 9 日起,把原本只覆盖高影响账号的“恢复码登录后 72 小时安全冻结”扩展到所有账号。使用恢复码成功登录后,账号会在 72 小时内暂停发布包等敏感写操作,以延缓账号被接管后的恶意发布。

OpenAI 于 2026 年 9 月 10 日把 ChatGPT 里的全双工语音模型 GPT-Live-1 开放到 API,开发者可以拿它搭建能边听边说、支持打断的电话与客服类语音代理。

OpenAI 于 2026 年 9 月 10 日推出 ChatGPT for Financial Services,把 Daloopa、PitchBook、LSEG News、Crunchbase 等金融数据内置进产品,并搭载 GPT‑6 Astra 做推理,首批瞄准投行与股票研究场景。

OpenAI 与美国总务管理局(GSA)达成一项多年协议,为联邦、州、地方和部落政府提供 ChatGPT 企业版免许可费、使用费五折的待遇,并扩大对政府网络安全防御者的支持。这意味着约 2300 万美国公共部门从业者被纳入优惠覆盖范围。