OpenAI推出“Ultrafast”新模式,使GPT 5.6 Sol运行速度提升14倍

OpenAI 于 2026 年 8 月 13 日推出名为 Ultrafast 的新处理模式,让旗舰模型 GPT-5.6 Sol 的生成速度提升至标准模式的 14 倍(最高每秒 750 个输出 token),目前以预览形式向少量客户开放。这次提速不是靠换小模型,而是从算力和推理层面优化,值得关注。

一句话看懂:OpenAI 于 2026 年 8 月 13 日推出名为 Ultrafast 的新处理模式,让旗舰模型 GPT-5.6 Sol 的生成速度提升至标准模式的 14 倍(最高每秒 750 个输出 token),目前以预览形式向少量客户开放。这次提速不是靠换小模型,而是从算力和推理层面优化,值得关注。

事件核心:发生了什么

据 TechCrunch 报道,OpenAI 在周四(8 月 13 日)发布博客,宣布推出一种名为 Ultrafast 的新模式,用于加速其最新、最强大的模型 GPT-5.6 Sol。官方称,Ultrafast 能以标准处理 14 倍的速度运行,每秒可输出最多 750 个 token(token 是大模型生成文本时的基本单元)。该模式目前属于预览版,由 OpenAI 与芯片制造商 Cerebras 的合作提供支持,现阶段仅面向一小部分客户开放,OpenAI 表示会随着“容量增长”逐步扩大使用范围。

OpenAI 强调,过去要想获得实时响应速度,通常只能选择更小或更专业的模型,而 Ultrafast 展示了另一种路径:让同一个大模型在单位时间内完成更多有用工作。其目标应用场景包括事件响应、客户服务与支持、金融市场分析和电子商务等企业工作流。

为什么重要

这项发布说明大模型竞争的重点正在从“模型能多聪明”扩展到“模型能多快”。此前 Anthropic 也为 Claude 推出过快模式(fast mode),但其速度并未达到 OpenAI 这次的水平。Ultrafast 的 14 倍提速一旦在更大范围落地,将直接影响实时交互类 AI 应用的用户体验,也意味着推理阶段的算力优化和芯片合作成为新的差异化竞争点。对 OpenAI 而言,这也是在商业化层面巩固企业客户、扩展高价值场景布局的一部分。

对用户/开发者/创作者的影响

对于普通用户,ChatGPT 的响应延迟有望大幅下降,对话感觉会更接近真人交流,尤其在进行多轮复杂对话时体验提升明显。对开发者而言,如果未来 Ultrafast 通过 API 开放,那么调用 GPT-5.6 Sol 时可以用同样成本换取更快的 token 流,或是在相同延迟预算内跑更大的模型,这会影响实时客服、代码辅助、内容批处理等应用的架构设计。对企业客户来说,金融市场分析、事件响应这类对时间敏感的任务将变得更可行,但需要注意的是,目前预览版的获取资格和定价尚未披露,实际可用性仍有限。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

目前公开信息显示,Ultrafast 只是预览版,有几个点值得继续观察:其一,OpenAI 何时扩大客户范围,是否会同步调整 API 价格或增加新的计费档位;其二,Anthropic 等竞争对手是否会跟进提升速度,“高速推理”是否会成为旗舰模型的标配功能;其三,Cerebras 与 OpenAI 的合作深度是否会在后续模型中继续体现,以及高速模式下的 token 质量、复杂任务表现是否与标准模式保持一致。

来源:TechCrunch AI

celebrityanime
celebrityanime
文章: 18281

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注