NVIDIA 介绍 Blackwell GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

OpenAI 的 GPT-6 Astra Ultrafast 已通过 API 和 ChatGPT Work、Codex 面向合格用户开放,依托 NVIDIA Blackwell GPU 与推理优化,token 生成速度最高可达 Astra Standard 模式的 8 倍。这说明大模型的竞争焦点,正从“能不能…

一句话看懂:OpenAI 的 GPT-6 Astra Ultrafast 已通过 API 和 ChatGPT Work、Codex 面向合格用户开放,依托 NVIDIA Blackwell GPU 与推理优化,token 生成速度最高可达 Astra Standard 模式的 8 倍。这说明大模型的竞争焦点,正从“能不能答”进一步转向“多快答完、多快进入下一轮工具调用”。

事件核心:发生了什么

根据 NVIDIA 博客信息,GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,目前已在 OpenAI API 中提供,并向符合条件的 ChatGPT Work 和 Codex 用户开放。其加速来自 OpenAI 针对自家模型所做的推理优化,能够调用 Blackwell 架构的能力,使 token 生成速度最高达到 Astra Standard 模式的 8 倍。OpenAI 推理负责人 Philippe Tillet 表示,Astra 可以把对 NVIDIA GPU 编程与文档的积累转化为高性能内核;OpenAI 算力 CTO Uday Ruddarraju 则称,团队用内部模型优化了 NVIDIA GPU 上的推理,NVIDIA 的可编程性帮助实现了这次加速。

为什么重要

这条新闻的关键词不是“更聪明”,而是“更快地反复调用”。在编码代理等场景里,模型要不断写代码、调用工具、检查结果、再决定下一步,速度会被工作流放大。Ultrafast 将 Astra 的能力带入这些对延迟敏感的任务循环,意味着推理效率本身正在成为模型商业化和开发者体验的一部分。对 NVIDIA 而言,这也强化了其 GPU 在训练、推理和强化学习之间复用基础设施的叙事;对 OpenAI 而言,则是在闭源模型服务上继续拉开响应速度和部署效率。

对用户/开发者/创作者的影响

对开发者来说,API 中可用的 Ultrafast 有望缩短编码代理的“编辑—测试—调试”周期,减少工具调用之间等待模型生成响应的时间,让交互式应用更接近即时反馈。对 ChatGPT Work 和 Codex 的合格用户,日常编码和任务处理会更快,但具体配额、价格和可用范围仍需以官方 Ultrafast 指南为准。对创作者和企业而言,目前公开信息显示,这项更新主要影响推理速度和响应体验,而不是直接改变模型能力边界;如果应用依赖多轮工具调用或长链路自动化,提速带来的收益会更明显。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

可以继续观察三点:一是 API 定价和速率限制是否随 Ultrafast 调整;二是 Codex、ChatGPT Work 之外,普通 ChatGPT 用户何时能用上;三是 Google、Anthropic 等竞品是否会跟进类似的推理加速与代理工作流优化。此外,OpenAI 提到会持续用自家模型改进 NVIDIA GPU 上的推理软件,这部分后续能否形成可复用的部署方案,也值得开发者关注。

来源:NVIDIA Blog(RSS)

celebrityanime
celebrityanime
文章: 26818

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注