OpenAI联合Cerebras推出Ultrafast模式,GPT-5.6Sol提速14倍

OpenAI联合芯片厂商Cerebras推出GPT-5.6Sol的“Ultrafast”模式,在处理速度和输出吞吐量上大幅提升,每秒生成token数达到750个。这项技术让旗舰大模型首次具备了进入高实时性企业场景的能力,也把大模型竞争从“参数规模”拉到了“推理效率”维度。

一句话看懂:OpenAI联合芯片厂商Cerebras推出GPT-5.6Sol的“Ultrafast”模式,在处理速度和输出吞吐量上大幅提升,每秒生成token数达到750个。这项技术让旗舰大模型首次具备了进入高实时性企业场景的能力,也把大模型竞争从“参数规模”拉到了“推理效率”维度。

事件核心:发生了什么

2026年8月13日,OpenAI正式推出面向旗舰大模型GPT-5.5Sol的“Ultrafast”(超快)模式。官方数据显示,该模式在保持原有智能水平和输出质量的前提下,运行速度比标准处理模式最高提升14倍,每秒可生成750个输出token。该功能由OpenAI与芯片厂商Cerebras联合开发,目前处于预览阶段,仅向部分企业客户开放,并将在算力扩容后逐步扩大覆盖范围。

此前,大模型应用长期面临“模型能力”与“响应速度”的取舍,实时交互场景通常被迫使用参数规模更小的模型。Ultrafast模式的落地,意味着GPT-5.6Sol可以直接进入对延迟高度敏感的复杂工作流,例如事件响应、客户服务、金融市场分析和电商场景。

为什么重要

这次发布的核心信号是:大模型竞争的重心正在从“模型聪明程度”向“推理效率”迁移。过去,企业如果想要低延迟响应,往往需要在模型能力上做妥协;Ultrafast模式通过芯片层优化和计算架构协同,尝试同时满足“高智能”和“低延迟”两个要求,这对于企业级AI的实时化部署有实质性意义。

此外,联合Cerebras这一动作值得关注。Cerebras以专用AI芯片和大规模计算系统见长,与英伟达GPU路线不同,这种“算法+专用芯片”的协同开发模式,可能为OpenAI在推理成本和吞吐效率上带来差异化优势。相比Anthropic Claude的fast模式,OpenAI在输出吞吐量和执行效率上表现出更强的指标,也反映出其在推理基础设施上的投入正在形成竞争壁垒。

对用户/开发者/创作者的影响

对企业用户:如果你所在的企业正在评估客服、实时分析或自动化决策流程,Ultrafast模式意味着“旗舰模型跑实时业务”不再是理想化设想。只需等待算力覆盖范围扩大,就能用更强的模型替换掉此前为速度而牺牲质量的小模型。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对开发者:低延迟和高吞吐会直接影响API调用体验。更快的输出速度意味着更短的等待时间,这为构建AI Agent、实时交互应用和复杂工作流自动化提供了条件,也让开发者不再需要为速度妥协而维护多套不同参数的模型。

对创作者:文本生成速度的提升可以明显减少内容生产中的等待感,尤其适合批量生成、实时改写和交互式创作等场景。但要注意,目前该功能仍处于企业客户预览阶段,普通用户和独立开发者未必能立即通过API使用,效果与定价还需等待正式上线验证。

值得关注的后续

1. 定价与开放节奏:Ultrafast模式进入公开API后,是否会按token数计价还是按加价服务计价?目前仍然没有明确信息,需要关注OpenAI后续的定价策略。

2. 算力能否跟上:Cerebras的硬件供给能力直接决定该模式的开放速度。若企业客户需求旺盛,可能会形成较长的排队期,这也是观察双方合作深度的窗口。

3. 竞品是否跟进:Anthropic等竞争对手在fast模式上已有布局,此次OpenAI将速度指标拉高后,行业内其他大模型厂商是否会通过芯片合作或架构优化做出响应,将直接影响企业客户对推理基础设施的选择。

来源:AIbase

celebrityanime
celebrityanime
文章: 18344

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注