OpenAI 的 GPT-5.6 在美国政府强行推迟后于周四发布

OpenAI 的最新大模型 GPT-5.6 系列(含旗舰版 Sol Ultra)将于本周四正式向公众开放。此前该模型因美国政府要求额外安全测试而被推迟发布,OpenAI 对此公开表达了不满。这一事件凸显了 AI 监管与商业效率之间的持续张力。

OpenAI 的 GPT-5.6 在美国政府强行推迟后于周四发布

一句话看懂:OpenAI 的最新大模型 GPT-5.6 系列(含旗舰版 Sol Ultra)将于本周四正式向公众开放。此前该模型因美国政府要求额外安全测试而被推迟发布,OpenAI 对此公开表达了不满。这一事件凸显了 AI 监管与商业效率之间的持续张力。

事件核心:发生了什么

OpenAI 于 6 月底发布了 GPT-5.6 系列模型,其中包括旗舰版本“Sol”和“Sol Ultra”。然而,在美国商务部下属的 AI 标准与创新中心(Center for AI Standards and Innovation)要求进行额外测试后,该模型仅限部分合作伙伴先行使用。据 Axios 报道,这些附加测试现已完成,商务部批准了 GPT-5.6 的公开上线。OpenAI 方面公开批评了此次延迟,认为这阻碍了开发者和企业使用最先进的工具。目前特朗普最新 AI 行政令中要求的、针对此类模型发布的约束性标准仍未出台。

在性能数据方面,GPT-5.6 Sol Ultra 在 TerminalBench 2.1 编程基准测试中取得了 91.9% 的得分,超越了 Anthropic 的 Claude Mythos 5(88.0%),而 Google 的 Gemini 3.1 Pro Preview 得分为 70.7%。在网络安全任务中,Sol 以仅三分之一的 token 消耗量达到了与 Mythos 5 相当的水平。

GPT-5.6 Sol 的 API 价格为每百万输入/输出 token 5 美元/30 美元;相比之下,Anthropic 的 Fable 5 价格为每百万输入/输出 token 10 美元/50 美元,且预计 token 消耗量更大。

为什么重要

此次推迟发生在缺乏正式监管框架的背景下,反映了尖端 AI 模型发布面临的政策不确定性。OpenAI 的公开批评表明,在安全审查缺乏统一标准和明确时限的情况下,监管干预可能成为大模型商业化的非技术性障碍。

从竞争格局看,GPT-5.6 Sol Ultra 在编程和网络安全领域的基准优势,进一步巩固了 OpenAI 在通用大模型能力上的领先地位。API 定价相比 Anthropic 更具性价比,这可能推动更多开发者从竞品迁移至 OpenAI 生态。

对用户/开发者/创作者的影响

对于开发者而言,GPT-5.6 系列提供了更高效且成本更低的编程和任务执行能力,特别是在需要大量推理的场景下(如自动化代码生成、安全审计)优势明显。创作者和企业用户则可能通过更稳定的 API 获得质量更高、延迟更低的文本生成服务。需要注意的是,目前公开信息显示,GPT-5.6 的公开上线尚不涉及图像生成或多模态能力,产品形态以纯对话和 API 形式为主。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

  1. 监管落地进程:美国政府是否会依据最新 AI 行政令出台正式的模型发布约束性标准,以及这些标准将如何具体影响未来模型的审批周期。
  2. 定价与生态迁移:GPT-5.6 Sol 的低 token 消耗和更有竞争力的定价,是否会在开发者社区引发从 Anthropic 等竞品的显著迁移。
  3. 基准测试的边界:TerminalBench 2.1 和网络安全任务的高分是否能在真实复杂项目中复现,以及能否转化为可量化的商业产出。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 14596

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注