OpenAI 发布 GPT-6 Astra,主打桌面自动化与网络安全 Critical 档位

OpenAI 发布 GPT-6 Astra,试图把 AI 从“对话答题”推进到“接管电脑操作”,并首次将模型安全分级拉到 Critical 档位。它在数学难题上确有突破,但在通用考试基准上仍落后于 Claude 系模型。

一句话看懂:OpenAI 发布 GPT-6 Astra,试图把 AI 从“对话答题”推进到“接管电脑操作”,并首次将模型安全分级拉到 Critical 档位。它在数学难题上确有突破,但在通用考试基准上仍落后于 Claude 系模型。

事件核心:发生了什么

OpenAI 于 2026 年 9 月 4 日正式发布 GPT-6 Astra,主打两大能力:桌面自动化与高阶推理。根据“阿易 AI Notes”的整理,GPT-6 Astra 在纯数学与计算领域完成了 10 道开放难题的形式化证明,其中包括构造 non-sofic 群与推翻 Connes 刚性猜想,全程使用 Lean 证明语言,单题推理成本约为 2000 美元。

在自动化方面,该模型在 ScreenSpot 基准上达到 92.7%,在 AutomationBench 上达到 41.4%,后者较前代翻倍。API 定价为每百万 Token 10 至 50 美元,支持 105 万 Token 的超长上下文,并在系统层面引入了异步工具调度能力。

值得强调的是,OpenAI 首次将模型安全等级标注为 Critical(网络安全就绪)。在 ExploitBench 测试中,GPT-6 Astra 达到 100% 的漏洞利用成功率,因此其高级网络安全能力仅在名为 Daybreak 的白名单项目中受控开放。

首批使用范围有限:仅面向部分机构以及 ChatGPT Plus、Pro 和企业版的桌面端用户,免费版暂未开放。此外,在 Humanity’s Last Exam 综合基准上,GPT-6 Astra 得分约 57%,仍落后于 Anthropic Claude Fable 5.1 的大约 65%。

为什么重要

GPT-6 Astra 的发布标志着行业竞争焦点正从“模型会说什么”转向“模型能在电脑上做到什么”。桌面自动化能力的显著提升意味着 AI 开始进入真实工作流——不只是生成文本,而是直接操作系统、调度工具、跨应用完成任务,这与单纯提升聊天体验有本质区别。

安全分级到 Critical 是一把双刃剑:一方面证明 OpenAI 在渗透测试与漏洞利用上的技术积累已经超过一般商业产品阈值;另一方面,这也迫使整个行业重新讨论“高性能 AI 双用途风险”的边界。首个 Critical 档位既是一种能力宣示,也是一种治理压力。

在竞争层面,GPT-6 Astra 在数学推理上确实做出了一批可验证的学术贡献,但在覆盖更广知识面的综合考试中仍被 Claude Fable 5.1 压制。这说明 OpenAI 在“深推理”与 Anthropic 在“广知识”之间的路线差异仍在持续,尚未分出最终胜负。

对用户/开发者/创作者的影响

普通用户:桌面端用户短期内能体验到自动操作这一核心变化,例如跨软件整理文件、执行重复性办公流程,但需要先取得 Plus/Pro 或企业版资格。免费用户暂时无法触及 Astra。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

开发者与企业:API 的 $10/$50 每百万 Token 定价处于高端区间,叠加异步工具调度和超长上下文能力,说明它更偏向复杂自动化工作流开发,而非高频低成本的通用对话。想要调用网络安能力(如自动漏洞利用方向的测试)的团队必须进入 Daybreak 白名单,普通开发者无法直接使用。

创作者:这一代产品在图像、视频等生成方向并未突出新能力,对纯内容创作人群的即时价值有限,其影响更多体现在“用自动化替代人工操作流程”的效率场景中。

值得关注的后续

目前公开信息显示,后续有四个观察点值得跟进:第一,桌面自动化在复杂软件(如专业设计工具、老旧企业系统)上的实际稳定性,是否对得起 41.4% 的 AutomationBench 成绩;第二,Daybreak 白名单的申请门槛与安全事件问责机制如何落地;第三,Anthropic 是否会针对 GPT-6 Astra 的综合基准优势发布新一代模型,进一步抬高通用考试分数线;第四,Critical 安全档位是否会引发美国或其他地区监管机构对高级 AI 模型开源的更严厉限制。

来源:X:阿易 AI Notes (@AYi_AInotes)

celebrityanime
celebrityanime
文章: 22314

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注