一句话看懂:OpenAI 于 2026 年 7 月 30 日大幅下调 GPT‑5.6 系列价格,其中 Luna 模型降价 80%,输入价格降至$0.20/百万 tokens,输出$1.20/百万,直接低于 Google Gemini 3.1 Flash‑Lite 和 Anthropic Claude Haiku 4.5,成为当前性价比领先的推理模型。
事件核心:发生了什么
OpenAI 在 2026 年 7 月 30 日宣布 GPT‑5.6 系列价格调整:GPT‑5.6 Terra 降价 20%,而 GPT‑5.6 Luna 降价幅度高达 80%。降价后,Luna 的输入价格为$0.20/百万 tokens,输出$1.20/百万 tokens,低于 Google 最便宜模型 Gemini 3.1 Flash‑Lite 的输入$0.25/百万、输出$1.50/百万,也远低于 Anthropic Claude Haiku 4.5 的$1/百万输入和$5/百万输出。OpenAI 解释此次降价主要得益于使用 GPT‑5.6 Sol 进行推理优化——通过 Sol 自动重写生产级内核、优化前向传播计算,减少无效内存移动和 GPU 空闲,最终将端到端推理成本降低约 20%。值得注意的是,Sol 本身也是 GPT‑5.6 家族的一员,形成了“用模型优化模型”的闭环。
为什么重要
Luna 价格降至新低,直接改变了低价推理市场的竞争格局。此前 AI 模型定价的“性价比”竞争更多集中在中型模型之间,而 Luna 以接近甚至低于头部轻量模型(如 Gemini Flash‑Lite)的价格,提供 GPT‑5.6 级别的能力,这迫使 Google、Anthropic 等对手必须重新评估定价策略。更深层看,OpenAI 展示了“模型自优化推理”的商业可行性——通过大模型编写和优化 CUDA 内核(基于开源的 Triton 和 Gluon 语言),在硬件不变的情况下持续降低单位推理成本,这暗示未来模型自身的“算力效率”可能成为比参数规模更重要的竞争维度。
对用户/开发者/创作者的影响
API 开发者:以 Luna 的新定价,高频调用场景(如客服、摘要、内容审核)的推理成本可能下降 60%–80%,使得更多中小团队可以承担实时对话或批量处理任务。Simon Willison 的 demo 网站已从 Gemini 切换至 Luna,说明实际迁移已发生。
内容创作者:对于需要大量调用生成文本的写作辅助、翻译或营销工具,Luna 的输入输出价格比 Haiku 4.5 低 80%,直接将单次推理成本从几分钱降至不足 1 分钱,可能催生更多“免费版”或“无限次使用”的产品。
企业采购:决策时应关注 Luna 是否保留 GPT‑5.6 的关键能力(如长上下文、多模态支持),目前公开信息显示 Luna 作为 5.6 系列一员,性能应显著优于轻量模型,但具体基准数据尚待第三方验证。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
1. 竞品跟进情况:Google 已拥有 Gemini 3.1 Flash‑Lite,Anthropic 也可能快速调整 Haiku 4.5 定价或推出更低成本版本,价格战可能进一步加剧。
2. 模型自优化的生态影响:OpenAI 开源的 Triton 和 Gluon 语言能否成为行业标准?其他厂商是否也能用类似方法压低推理成本?这将决定未来半年内 API 价格的整体走向。
3. Luna 可用性与性能:降价后是否会出现调用激增导致的稳定性问题?以及 Luna 在复杂推理、代码生成等任务上的实际表现是否与 Terra 一样可靠——这需要更多开发者的生产环境反馈。


