一句话看懂:Anthropic 旗下 Claude Devs 公布 Opus 5.5 相较 Opus 5 的定价调整:输入输出 token 便宜 20%,缓存读取便宜 60%,并推出一款可从 /usage 调用、测算 Claude Code 单任务成本的计算器。
事件核心:发生了什么
据 Claude Devs 在 X 发布的帖子,Opus 5.5 的 token 单价相比 Opus 5 有明确下调:每百万输入与输出 token 的价格降低 20%,而缓存读取(cache reads)部分降幅达 60%。团队表示,降价不等于任务成本同比变化,因为一个真实任务往往混合普通 token 与缓存 token,比例不同,账单差异也不同。为此他们做了两件事:一是基于实际使用数据测算 Claude Code 任务在 Opus 5.5 下的花费,二是上线一个成本计算器,开发者可直接通过 /usage 命令运行,用自己的用量数据估算成本。帖子发布于 2026 年 9 月 25 日,浏览量已超过 20 万。
为什么重要
大模型的定价竞争正从“每百万 token 单价”转向“真实任务成本”。缓存读取降价 60% 是更关键的一项——在 Claude Code 这类编码代理场景中,系统提示、代码库上下文、历史对话会被反复读取,缓存 token 占比往往很高。因此这轮调整对重度用户的费用影响,可能明显超过 20% 的标价降幅。目前公开信息显示,这种“任务级成本”叙事也在成为厂商差异化竞争的新抓手:在模型能力接近时,谁能让开发者的实际账单更低,谁就更容易留在工作流里。
对用户/开发者/创作者的影响
对使用 Claude Code 做日常开发、代码审查或批量重构的开发者,缓存读取便宜 60% 意味着长会话、大代码库场景的边际成本下降更显著,适合把以前因成本而放弃的高频调用重新纳入流程。团队提供 /usage 计算器,也降低了估算门槛——不必等月底账单,可先按自己的输入、输出、缓存比例算清楚再决定是否切换模型。对企业采购方而言,评估重点应从单价表转向单位任务成本:同样的任务在 Opus 5.5 上究竟便宜多少,取决于缓存命中率,建议用自身真实负载做一次对比测试。创作者若通过 API 调用 Claude 做内容生成或自动化,也可关注输出 token 的 20% 降幅,但缓存部分的收益通常不如编码场景明显。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
其一,Opus 5.5 的任务成本降幅是否有官方基准数据,例如典型 Claude Code 任务的平均节省比例;其二,其他厂商是否跟进缓存读取定价,把“缓存友好”变成 API 的标准竞争维度;其三,/usage 计算器能否沉淀为开发者社区的公开成本基准,影响模型选型与采购决策。


