一句话看懂:OpenAI 旗下 Codex 产品负责人 Thibault Sottiaux 于 2026 年 7 月 29 日宣布,已重置所有 ChatGPT Work 和 Codex 用户的用量限制,并针对 GPT-5.6 Sol 模型用量消耗过快的问题进行修复,预计典型使用场景下用量将延长约 18%,部分重度用户改善更明显。
事件核心:发生了什么
OpenAI 的 Thibault Sottiaux 在 X 上发布了一则更新,解释了 GPT-5.6 Sol 在 Codex 环境中用量消耗异常的原因。用户反馈 Sol 使用 Codex 限额的速度比预期快。经过调查,团队发现原因包括:Sol 更愿意长时间工作、进行更多工具调用,特别是在代码模式下并行执行工具调用导致每次交互产生更多响应和缓存输入 token;另外,Sol 在相同推理努力等级下消耗的 token 比 GPT-5.5 更高。这些影响分布不均:中位数用户感觉效率尚可,但处理复杂任务的 power user 用量消耗极快。OpenAI 已进行多项改进,预计典型用量延长约 18%,并将在次日恢复此前暂停的五小时限制。
为什么重要
这次事件直接暴露了 OpenAI 在模型效率与能力平衡上的真实问题。GPT-5.6 Sol 是一款面向编程和复杂工作流的高能力模型,但能力越强,推理和工具调用成本越高。之前团队主要关注平均和中等用量指标,忽略了长尾重度用户的异常消耗。这种“能力优先,效率后来补齐”的发布策略在 AI 行业并不罕见,但会影响用户对订阅价值(特别是 Codex 套餐)的信任。OpenAI 选择公开复盘并快速修复,反映出其面对企业级用户时更务实的姿态,也可能影响后续模型发布前的测试标准——需要更早覆盖真实场景的极端使用模式。
对用户/开发者/创作者的影响
对于 Codex 和 ChatGPT Work 用户:用量效率将明显提升,特别是高频调用 Sol 进行复杂任务(如多步骤自动化、大批量 API 调用、多工具协同)的用户,改善幅度可能大于 18%。但用户仍需注意,Sol 在代码模式下仍比 GPT-5.5 更“耗能”,建议关注具体 token 消耗趋势并调整任务拆分策略。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于开发者:如果使用 Codex 的 API 或基于 GPT-5.6 Sol 构建应用,应意识到模型在并行调用和长时间推理上的 token 开销。可以针对“等待工具完成”和“大量网页搜索”等场景做任务优化,或调整请求的超时和批处理策略以降低成本。
对于内容创作者和企业采购者:此次事件提示,选择 AI 模型时不应只比较基准能力,还要考虑实际场景下的 token 效率和限额耗尽风险。建议在采购前进行压力测试,覆盖长尾使用模式。
值得关注的后续
- OpenAI 是否会在未来几周发布关于 GPT-5.6 Sol 更详细的 token 消耗白皮书,帮助用户预估成本。
- Codex 套餐的定价或限额结构是否会调整 —— 如果效率提升有限,重度用户可能要求更透明的计费方式或更高 tier 的计划。
- 竞品(如 Claude 的 Codex 风格工具或 Google 的 Gemini Code Assist)如何利用这次事件吸引对用量敏感的开发者。


