AWS Bedrock 上 Codex 的 bug 导致费用暴涨 10 倍

有开发者在 GitHub 上报告,OpenAI Codex CLI 接入 AWS Bedrock 后,因缺乏对 GPT-5.6 Sol 模型显式提示缓存的启用支持,导致缓存写入 token 激增,估算费用上涨至正常水平的近 10 倍(4 天约 1386 美元,其中缓存写入占 85%)。

一句话看懂:有开发者在 GitHub 上报告,OpenAI Codex CLI 接入 AWS Bedrock 后,因缺乏对 GPT-5.6 Sol 模型显式提示缓存的启用支持,导致缓存写入 token 激增,估算费用上涨至正常水平的近 10 倍(4 天约 1386 美元,其中缓存写入占 85%)。

事件核心:发生了什么

8 月 9 日,一位用户在 OpenAI Codex 官方仓库提交 issue(编号 #37674),指出 Codex CLI 0.147.0 版本在通过原生 Amazon Bedrock 提供商调用 GPT-5.6 Sol 模型时,无法使用 AWS 文档中明确支持的“显式提示缓存”机制。该问题在 8 月 5 日至 8 月 8 日的生产环境使用中造成明显成本异常:4 天共发起 3656 次请求,产生 1.72 亿个缓存写入 token,估算缓存写入费用高达 1182.09 美元,占模型总估算费用(1386.46 美元)的约 85%。相比之下,本地会话中同样请求的缓存读取 token 为零,意味着每次请求都在重复写入相同的前缀内容,而非命中缓存。

为什么重要

这一 bug 暴露了 AI 编码工具在云原生部署中的成本控制盲区。GPT-5.6 Sol 这类为智能体工作流设计的模型,通常依赖长时间稳定的系统指令和工具定义来保持上下文一致性;显式提示缓存正是为了降低这类重复前缀带来的推理成本。Codex 在 Bedrock 上默认关闭该能力,直接导致开发者为无效的 token 重复计费。这不仅影响单个开发者账单,也对 AWS 与 OpenAI 在企业市场的合作构成信任成本——企业客户在评估 Bedrock 上的 Codex 方案时,会将此类“隐藏溢价”视为采用障碍。目前公开信息显示,该 issue 已被标记为 enhancement(功能增强),并关联了 rate-limits 与 token 用量报告类别。

对用户/开发者/创作者的影响

对于使用 Codex CLI 且通过 AWS Bedrock 路由流量的开发者,最直接的冲击是账单:在长会话、频繁工具调用的智能体场景下,若未主动监测缓存写入指标,月底费用可能远超预期。该 issue 建议用户检查 CloudWatch 中的 cache_write_input_tokens 与 cached_input_tokens 指标以定位问题。对希望自行规避成本的团队,现阶段没有通过 config.toml 配置请求体转换的临时方案,只能等待官方补丁或改用非原生提供商。对 AI 工具链的采购决策者而言,这一事件也提示:在评估“模型 + 云平台”组合时,需要将缓存机制的可配置性视为功能需求,而非仅仅比较单次 token 单价。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

后续观察点包括:一是 OpenAI 是否会在近期 Codex 版本中为 Bedrock Responses API 补齐 prompt_cache_options 与 prompt_cache_breakpoint 的序列化支持;二是 AWS 是否会调整 GPT-5.6 在 Bedrock 上的计价方式或默认缓存策略,以降低客户试错成本;三是社区是否会形成针对 Codex 在各类云提供商上的费用监控插件,毕竟该类问题对使用 Azure 或自建基础设施的用户同样具有参考价值。

来源:Hacker News (黑客新闻)

celebrityanime
celebrityanime
文章: 19632

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注