OpenAI 周五因网络风险暂停了一款模型,周一又发布了一款经训练、拒绝率更低的模型。

OpenAI 于周一发布了网络安全专用模型 GPT-5.6-Cyber,该模型在网络攻防任务中的完成率从上一代的 57.3% 跃升至 95.0%,但仅限通过其审查项目 Daybreak 访问。三天前 OpenAI 刚推迟了 Astra,一推一发看似矛盾,实则都遵循同一套安全评估框架。

一句话看懂:OpenAI 于周一发布了网络安全专用模型 GPT-5.6-Cyber,该模型在网络攻防任务中的完成率从上一代的 57.3% 跃升至 95.0%,但仅限通过其审查项目 Daybreak 访问。三天前 OpenAI 刚推迟了 Astra,一推一发看似矛盾,实则都遵循同一套安全评估框架。

事件核心:发生了什么

OpenAI 本周一发布 GPT-5.6-Cyber,这是一个基于 GPT-5.6 Sol 二次训练的专用模型,面向零日漏洞发现和漏洞利用链开发。据 Axios 记者 Sam Sabin 报道,该模型仅通过 Daybreak 项目提供访问权限。Daybreak 现拆分为两个通道:Daybreak Blue 提供带系统级网络防护移除的通用前沿模型,面向防御工作;Daybreak Red 则承载专业网络模型,用于授权漏洞研究和安全测试。

OpenAI 的内部指标“高级网络安全完成率”显示,GPT-5.6-Cyber 在漏洞利用链开发、身份验证绕过、提权等任务上的完成率达到 95.0%,上一代 GPT-5.5-Cyber 仅为 57.3%,而普通 Sol 在 Daybreak Blue 中只有 2.0%,带标准防护的 Sol 为 1.5%。在实际测试中,该模型在 Chrome 的 V8 JavaScript 引擎中发现了两个此前未知的漏洞,可被链式利用以逃逸沙箱,Google 已在协调披露后修复,编号为 CVE-2026-15903。此外还报告了一个广泛使用的移动操作系统的至少 5 个漏洞、一个流行数据库的 3 个关键漏洞,以及一个流行 OS 内核的超过 400 个提权漏洞,但涉及产品名称尚未公开。

为什么重要

这次发布的关键变化不是模型智商,而是“合规性”——同一类任务,模型从拒绝回答变为直接执行。与三天前推迟 Astra 对比,OpenAI 的解释自洽:Astra 无法排除达到 Critical 级别网络能力的风险,因此延期;GPT-5.6-Cyber 在 Preparedness Framework 下被评为 High,未触及 Critical 门槛,因此放行。这个框架管的是能力等级,不管访问权限,而权限才是本周的核心变化。

值得注意的是,基准测试并非全面领先。在漏洞发现和报告撰写上,GPT-5.6-Cyber 反而差于普通 Sol,OpenAI 归因于生成的分析报告更短、细节不足。在 ExploitBench 的 300 轮标准设置中,Daybreak

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

celebrityanime
celebrityanime
文章: 18306

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注