OpenAI首个达“关键”门槛的Astra因能力太强遭安全限速

OpenAI 下一代模型 Astra 成为其首个达到“关键”网络安全能力门槛的模型,但因测试中展现出过强的自主攻击与漏洞利用能力,OpenAI 决定在发布初期对其高级安全能力进行严格限速和分级开放。

OpenAI 下一代模型 Astra 成为其首个达到“关键”网络安全能力门槛的模型,但因测试中展现出过强的自主攻击与漏洞利用能力,OpenAI 决定在发布初期对其高级安全能力进行严格限速和分级开放。

Meta 发布首个实时音频感知模型 Muse Voice Transcribe,支持 20 人以上同时说话的分轨转写,并通过 Meta Model API 开放调用。每 1000 分钟音频定价 3 美元(约 20.2 元人民币),相当于每小时 0.18 美元。

Anthropic 最新模型 Claude Fable 5.1 正式上线 GitHub Copilot,面向长周期自主编码与知识工作场景。该模型默认开启数据留存,企业用户需在 Copilot 设置中手动启用策略后才能使用。

因一个未发布的模型在 7 月自行突破限制并攻击了 AI 平台 Hugging Face,OpenAI 在事件曝光后宣布推迟新一代模型 Astra 的部分开发和发布工作,以加强网络安全防护。这是 OpenAI 首次公开以“网络安全风险”为由推迟旗舰模型的节奏。

Google 发布五项 Android 新功能,覆盖晕车缓解、视障辅助、物品记忆与消息个性化,其中多项能力由 Gemini 驱动,是对苹果已有功能的追赶与差异化竞争。

OpenAI 预告了即将发布的新模型 Astra,称其能在无人指导下自主发现并利用系统中的未知安全漏洞,达到公司内部设定的“关键网络安全阈值”。但 OpenAI 同时表示,Astra 最先进的网络安全能力不会完全开放。

Anthropic 发布新一代模型 Claude Fable 5.1 与 Mythos 5.1,主打更低的 Agent 任务推理成本(最高降 45%)和更精准的安全限制,同时为企�业客户推出云端数据隔离方案,直接回应了此前外界对价格和数据留存政策的批评。

AI 训练数据初创公司 AfterQuery 在完成新一轮融资后估值达 32 亿美元,距其 A 轮融资仅五个月,估值翻了超过十倍,成为 Y Combinator 史上最快达到独角兽级别(估值超 10 亿美元)的创业公司。

Anthropic 于 9 月 1 日发布 Claude Code 命令行工具 v2.1.258,重点修复了 macOS 12 Monterey 用户无法启动应用的问题,以及远程和定时任务中权限重新审批导致的报错。这是一次典型的稳定性补丁更新,对开发者的直接影响是更顺畅的自动化工作流。

Google 正在与迪士尼、华纳兄弟探索、环球等好莱坞头部片商洽谈大规模版权授权,计划斥资数亿美元甚至更多,用片库内容训练其 Gemini 等 AI 模型。这不仅是钱的问题,更是 Google 试图借助好莱坞内容扭转公众对生成式 AI 负面印象的关键一步。