OpenAI 即将推出首款具备“关键”网络能力的 AI 模型

OpenAI 宣布其新一代模型 Astra 达到公司内部定义的“关键”网络安全能力阈值,能够自主发现并利用真实软件中的未知漏洞。该模型将很快公开发布,但高级网络攻防能力初期仅向 Cisco、Cloudflare 等特定合作伙伴开放。

一句话看懂:OpenAI 宣布其新一代模型 Astra 达到公司内部定义的“关键”网络安全能力阈值,能够自主发现并利用真实软件中的未知漏洞。该模型将很快公开发布,但高级网络攻防能力初期仅向 Cisco、Cloudflare 等特定合作伙伴开放。

事件核心:发生了什么

OpenAI 于周二确认,即将推出的 AI 模型 Astra 是其首个达到“关键”网络安全能力阈值的模型,这一标准出自公司此前公布的 Preparedness Framework 预备框架。达到该阈值意味着模型能在真实世界软件中独立发现并利用此前未知的漏洞(即零日漏洞),并能将多个漏洞利用链式组合,实现更深入的系统渗透。OpenAI 表示,在评估后曾暂停 Astra 及后续模型的训练数周以加固安全措施,目前相关工作已恢复。

公司计划“很快”公开发布 Astra,但高级网络安全功能在发布初期仅面向 Daybreak Blue 早期访问计划中的合作伙伴(包括 Cisco、Cloudflare、Palo Alto Networks 等数字基础设施提供商)以及政府机构。根据 OpenAI 提供的测试数据,Astra 在 ExploitBench 等网络安全基准测试中得分为 100%,优于 GPT-5.6 Sol 和 Anthropic 的 Mythos 等现有行业领先模型。

为什么重要

这一公告表明前沿 AI 模型的网络攻防能力正从理论预测走向实际落地。Astra 的能力与 Anthropic 在四月份披露的 Mythos Preview 可自主开发漏洞利用链的进展相互印证,说明主流 AI 实验室的模型能力曲线在网络安全维度正在同步攀升。OpenAI 在处理方式上选择了“能力分层开放”的策略:普通用户与受信任合作伙伴获得的是不同限制级别的版本,这是商业化与安全控制之间的一次明确折中,也可能成为后续 AI 能力分级发布的范式案例。同时,该消息与近期 Anthropic、Meta 披露的模型自主渗透事件形成呼应,凸显出顶级实验室面对自身模型失控风险的普遍焦虑。

对用户/开发者/创作者的影响

对普通用户而言,Astra 尽管能力更强,但 OpenAI 设置了多层限制:模型应拒绝协助查找真实软件漏洞的请求,并增强了针对越狱攻击(jailbreak)的防御能力。不过,官方也承认其“错位监控器”(misalignment monitor)可能会出现误判,将正常合法操作标记为网络滥用,导致任务被降速或暂停,使用 ChatGPT 和 Codex 的用户可能因此被要求额外确认操作内容。对开发者来说,Daybreak 计划中的合作伙伴将获得限制较少的 Astra 版本,用于在网络防御场景中提前部署;有意使用高级网络能力的组织需要考虑自身的合规审核周期。对 ToB 采购方而言,该消息意味着 AI 驱动的安全攻防工具已进入商用测试阶段,但短期内并非普遍可用资源。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

值得关注的变化包括:第一,Astra 公开发布的具体时间及其各阶段可用性安排,以及公开版与合作伙伴版之间确切的能力差异;第二,OpenAI 的“错位监控器”在实际使用中的误报率是否影响开发者体验,特别是通过 API 调用时是否会引入额外审查延迟;第三,Anthropic 是否会在 Mythos 正式版发布时采取类似的能力分级策略,以及监管机构对大模型高级网攻能力的分发机制是否会提出新的透明度要求。目前公开信息未披露 Astra 全量开放的确切日期,以及该模型在非网络安全任务上的综合表现。

来源:Wired AI

celebrityanime
celebrityanime
文章: 21441

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注