GPT-5.6 Sol 速度提升 14 倍,OpenAI 推出由 Cerebras 驱动的超快模式

OpenAI 推出 GPT-5.6 Sol 的“Ultrafast”预览模式,输出速度最高达每秒 750 个 token,提速约 14 倍,由 Cerebras 的专用推理硬件驱动,初期仅面向部分 API 客户开放。

一句话看懂:OpenAI 推出 GPT-5.6 Sol 的“Ultrafast”预览模式,输出速度最高达每秒 750 个 token,提速约 14 倍,由 Cerebras 的专用推理硬件驱动,初期仅面向部分 API 客户开放。

事件核心:发生了什么

据 The Decoder 报道,OpenAI 于 8 月 14 日宣布为其旗舰模型 GPT-5.6 Sol 推出全新的“Ultrafast”模式预览。该模式将模型输出速度提升至每秒最高 750 个 token,相当于此前速度的 14 倍。加速能力来自 AI 芯片公司 Cerebras——OpenAI 今年早些时候已与 Cerebras 签署了价值 100 亿美元的合作协议。

目前,该服务仅通过 OpenAI API 提供,且只面向经过筛选的客户开放。OpenAI 表示,随着算力扩容,后续会逐步扩大使用范围,感兴趣的企业可通过官方表单申请更新通知。值得一提的是,OpenAI API 此前已有“Fast Mode”,承诺为 GPT-5.6 Sol 提供最高 2.5 倍的速度提升,但价格约为标准档的两倍。Ultrafast 模式相当于在现有分级上新增了一个更快、预计也更贵的档位。

为什么重要

这次更新不仅是单纯的性能提升,更值得关注的是其背后的商业化逻辑。OpenAI 正在把“推理速度”直接变成一种可售卖的服务等级,模式与 AWS 等云厂商按性能差异定价的做法类似。如果高速推理成为行业刚需,OpenAI 就能直接从客户因提速而创造的新增收益中分得一杯羹。

另一方面,Cerebras 的深度参与说明专用 AI 芯片在推理环节的市场地位正在上升。大模型竞争已从训练阶段延伸到推理效率,谁能在相同模型能力下提供更低延迟、更高吞吐的算力基础设施,谁就可能拿到更多企业级客户订单。

对用户/开发者/创作者的影响

对开发者而言,更快的推理速度意味着可以构建此前难以实现的实时应用,例如在故障响应中边分析日志边让工程师同步获得修复建议,或在电商场景中根据用户实时行为动态调整推荐方案。但需要注意的是,Ultrafast 模式初期只开放特定 API 客户,且价格档位预计不低,中小开发者短期内的实际使用门槛仍然较高。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业和组织来说,金融风控、智能客服、交互式科研等对延迟敏感的场景将率先受益。研究团队可以把原本需要通宵运行的批量实验,变成边思考边调整的交互式工作流。对普通用户而言,这一功能目前没有直接进入消费级产品的公开时间表,但可以预期,如果该模式表现稳定,未来很可能通过 ChatGPT 等入口间接落地。

值得关注的后续

有几个具体的观察点:第一,Ultrafast 模式从“预览”到正式商用后,定价策略和开放门槛是否会发生变化,现有 Fast Mode 客户是否会自动升级;第二,Cerebras 的产能是否能支撑 OpenAI 的规模化部署,双方 100 亿美元合作的执行进度值得跟踪;第三,谷歌、Anthropic 等竞争对手是否会跟进按速度分层定价的商业模式,从而推动整个行业对推理成本的重新定价。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 18447

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注