AWS Bedrock 上 Codex 的 bug 导致费用暴涨 10 倍

有开发者在 Hacker News 上反馈,OpenAI 的 Codex 在 AWS Bedrock 上运行时,因缓存机制异常导致推理费用飙升至正常水平的 10 倍左右,目前临时解法是关闭网络搜索功能。

一句话看懂:有开发者在 Hacker News 上反馈,OpenAI 的 Codex 在 AWS Bedrock 上运行时,因缓存机制异常导致推理费用飙升至正常水平的 10 倍左右,目前临时解法是关闭网络搜索功能。

事件核心:发生了什么

据 Hacker News 用户 TheP1000 反馈,其团队在使用 AWS Bedrock 上的 OpenAI Codex 时,发现读写缓存比例不足 5%,意味着缓存几乎从未被命中,而平台对缓存写入的计费又相当高昂。这种“只写不读”的异常状态,使得实际调用成本比预期高出约 10 倍。该用户表示,在关闭 web_search(网络搜索)功能后,问题得到缓解,并建议其他遇到同样问题的用户优先采用这一临时方案。

为什么重要

这一 bug 的曝光,折射出当前大模型 API 商业化中一个容易被忽略的成本结构问题:推理费用并非只按 token 计算,缓存命中率直接影响实际支出。对于将 Codex 这类编码智能体部署在 Bedrock 上的企业团队来说,如果缓存策略失效,成本可能瞬间失控。此事也提醒行业,模型能力的竞争之外,底层基础设施的计费逻辑与稳定性,正成为影响开发者选择平台(如 AWS Bedrock、OpenRouter 或其他聚合层)的关键变量。

对用户/开发者/创作者的影响

对依赖 API 进行编码辅助或批量任务处理的开发者而言,这一事件的核心警示是:在引入新的 AI 工具时,不仅要看单次调用的标价,更要关注缓存策略、写入计费规则以及默认开关(如 web_search)可能带来的隐性成本。目前公开信息显示,此问题并非 Codex 模型本身的推理能力缺陷,而是 Bedrock 集成环节的缓存机制 bug,但用户若未能及时发现,账单风险极高。建议相关团队在正式投入前,先在小流量场景下监测缓存命中率与成本曲线。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

其一,OpenAI 或 AWS 是否会针对该 bug 发布官方修复说明,并明确是否对受影响用户给予费用补偿或账单调整;其二,社区提到的 OpenRouter 等第三方聚合平台,是否会借此机会强调其在成本透明度和缓存策略上的优势,进而吸引更多开发者迁移;其三,此次事件是否会促使更多云厂商在智能体服务的控制台中,增加更直观的缓存命中率与成本异常预警功能。

来源:hackernews

celebrityanime
celebrityanime
文章: 19629

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注