OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布

OpenAI 在内部评估中认定其下一代模型 Astra 已具备“重大(Critical)”级别的网络安全能力,即能在无人逐步指导下自主发现并利用多个高防护系统中的未知漏洞。这是 OpenAI 首次将模型评定至该级别,因此 Astra 将采取更严格的防护措施并限制高级功能的开放范围。

一句话看懂:OpenAI 在内部评估中认定其下一代模型 Astra 已具备“重大(Critical)”级别的网络安全能力,即能在无人逐步指导下自主发现并利用多个高防护系统中的未知漏洞。这是 OpenAI 首次将模型评定至该级别,因此 Astra 将采取更严格的防护措施并限制高级功能的开放范围。

事件核心:发生了什么

OpenAI 在 9 月 1 日发布的最新评估报告中确认,Astra 已满足其《预备框架》中定义的 Critical 网络安全能力阈值。这一级别意味着模型能在给定高层目标后,自主设计并执行针对高防护目标的端到端攻击方案,或在无人干预的情况下发现并利用多个真实关键系统中的零日漏洞。

据 OpenAI 披露,Astra 在内部基准 ExploitBench 上取得满分,并在一个包含 20 个近期披露的高危 V8 漏洞的内部测试集中,实现了远高于前代 GPT-5.6 Sol 的任意代码执行成功率,且消耗的输出 token 显著更少。测试过程中,Astra 还自主发现并利用了两个零日漏洞,OpenAI 表示正在向相关维护方披露。此外,在专家主导的对加固浏览器和操作系统的测试中,Astra 成功构建了从浏览器沙箱逃逸到宿主机命令执行的完整攻击链,以及从普通用户提权至 root 的本地权限提升链。上述结果均基于 Daybreak Blue 工具链的访问配置,而非默认生产配置。

由于评定结果,OpenAI 推迟了 Astra 的部分开发和发布工作,用于强化针对网络滥用和模型未经授权行为的防护。公司表示,Astra 的发布将采用受限形式:其高级网络安全能力初期仅向一组测试人员开放,后续会通过 Daybreak Blue 逐步扩大防御性用途的访问。

为什么重要

这是 OpenAI 首次将模型评为 Critical 级网络安全能力,意味着前沿大模型在攻防两端的能力迈过了一个实际门槛——不再是辅助研究人员分析代码的工具,而是在特定工具链配合下可以独立完成从漏洞发现到利用开发的完整流程。对安全行业而言,这类能力既是防御测试的利器,也显著抬高了恶意使用的潜在风险。

此次评估还暴露了一个不可回避的事实:开放权重模型与闭源 API 的安全责任边界正在扩大。OpenAI 明确提到,虽然 Astra 未参与此前 Hugging Face 平台上的安全事件,但已将相关教训纳入防护设计,并强化了模型对有害网络请求的拒答训练和运行时监控。这一表态也反映出,前沿模型的能力越强,其发布节奏和访问控制就越可能脱离单纯的“技术发布”逻辑,转而受到内部安全评估的深度约束。

对行业竞争而言,OpenAI 率先公开定义并应用 Critical 级别的发布门槛,为后续其他大模型厂商的类似评估提供了参照系。同时也意味着,网络安全能力已成为前沿模型竞赛中一个独立的评测维度。

对用户/开发者/创作者的影响

对于普通用户和企业客户,Astra 的能力分级不会直接改变日常使用体验,但需要注意其高级网络安全能力不会出现在默认生产配置中。企业如果希望通过 API 调用 Astra 进行漏洞挖掘或渗透测试,将需要申请特定的测试者资格,而非购买即用。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对安全研究团队和防御方而言,Daybreak Blue 作为受控访问渠道的开放节奏值得关注,它可能成为未来高危能力模型的标准化交付模式:训练完成与可用访问之间出现明确分层。开发者若要基于 Astra 构建安全工具,需要提前了解访问条件、输出审计和监控机制,而不能假设完整能力对所有 API 用户开放。

另外,OpenAI 在评估中使用的内部基准(如非公开的 ExploitBench 变体)和专家驱动测试方法,也为安全行业评估大模型真实攻防能力提供了参考样本,而非仅依赖公开榜单分数。

值得关注的后续

目前公开信息显示,Astra 的完整系统卡将在正式发布时披露。接下来值得观察几个具体节点:一是 Astra 的实际发布时间和 API 定价,受限发布是否会影响其商业化节奏;二是 Daybreak Blue 的测试者申请门槛和监管审批流程,这将决定高级功能实际触达哪些机构;三是该评估结果是否促使 Anthropic、Google DeepMind 等竞争对手公布类似的能力分级标准,以及开源社区对高能力网络安全模型的态度是否会因此转向更严格的访问控制。

来源:OpenAI News

celebrityanime
celebrityanime
文章: 21400

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注