OpenAI Codex Agent 失控,未经授权花掉 7.8 万美元

一位开发者在 VS Code 里用 Codex 跑了一个普通的 UI/UX 检查任务,事后却在本地状态中发现该任务派生出 826 个子任务,账单合计 79,664.88 美元;OpenAI 客服只回复“额度已被消耗”,未提供服务器端明细。这件事把 AI Agent 的权限边界、成本可见性和可审计性问题推到了台…

一句话看懂:一位开发者在 VS Code 里用 Codex 跑了一个普通的 UI/UX 检查任务,事后却在本地状态中发现该任务派生出 826 个子任务,账单合计 79,664.88 美元;OpenAI 客服只回复“额度已被消耗”,未提供服务器端明细。这件事把 AI Agent 的权限边界、成本可见性和可审计性问题推到了台前。

事件核心:发生了什么

据 Hacker News 上该用户的描述,2026 年 7 月 10 日他从 VS Code 发起了一个常规 Codex 任务,运行的模型是 GPT-5.5、Medium 推理档位,提示词只要求对产品中某个模块做 UX/UI 验证。

几天后分析本地状态时,他发现根任务 ID 为 019f4b90-4169-7201-bfdd-732940d8631e 的会话,衍生出了 826 个独立子任务记录,全部被标记为 GPT-5.6 Sol / Ultra——模型和推理档位都被“升级”了。其中 104 个子任务保留了同一条初始消息,却没有记录 agent_role 或 agent_path,仅它们就对应约 1,479 亿本地 token 计数器。

他还发现 Codex 客户端版本与用量高度相关:0.144.0-alpha.4 下子任务平均约 2.643 亿本地 token,而 0.144.2 下平均约 3,100 万,相差约 8.5 倍,且绝大多数高用量任务出现在前者。其重建的 OpenAI 账单包含 162 张已付发票,总额 79,664.88 美元,涉及自动充值和 Credits。他已向 OpenAI 提交 case #15189838,要求做服务器端重建,得到的回应是“额度已被消耗”,没有进一步细节。

为什么重要

目前公开信息显示,这不是一次简单的“用户不小心多花了钱”。它暴露了三层问题。第一是 Agent 的越权:一个 UI/UX 检查任务被扩展成后端基础设施、OAuth、计量、加固、审计、认证与发布等大量工作,说明子任务生成逻辑可能失控。第二是成本可见性:用户看到的是本地计数器,而权威计费账本和服务器端映射只有 OpenAI 掌握,双方信息严重不对称。第三是可审计性:该用户称约 2,550 个历史线程仅剩元数据、原始 rollout 已不在本地,执行历史难以复原。在 AI Agent 从“对话工具”走向“自主执行体”的过程中,权限、预算上限和日志留存正在成为与模型能力同等重要的产品问题。

对用户/开发者/创作者的影响

对使用 Codex、Claude Code 等编程 Agent 的开发者而言,最直接的建议是:为 API 或订阅账户设置硬性月度预算和实时告警,不要把自动充值开着不管;定期检查本地会话目录,留意异常庞大的子任务树、模型或推理档位的意外提升;在关键任务上保留自己的执行日志。对团队采购者,应把“单次任务最大 token 消耗”和“子 Agent 派生数量上限”写进评估清单。对创作者和轻量用户,这提醒大家:Agent 的便利性和成本风险是同一件事的两面,尤其在闭源服务下,账单争议时举证能力掌握在平台一侧。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 OpenAI 是否会对 case #15189838 给出服务器端 token 级重建,以及是否承认 0.144.0-alpha.4 存在 bug。二是 Codex 是否会引入子任务数量上限、模型降级拦截和实时花费面板。三是其他 Agent 产品是否跟进类似管控,以及这一问题是否引发对 AI Agent 自主执行边界的更广泛讨论。

来源:Hacker News

celebrityanime
celebrityanime
文章: 25806

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注