Anthropic 发布 Claude Opus 5.5,面向更长、上下文更重的编码会话优化成本

Anthropic 发布 Claude Opus 5.5,针对越来越长、上下文越来越重的编码会话做成本优化,官方估算典型 token 计费工作负载下运行成本比 Opus 5 低约 40%。这背后是编码智能体用法正在从“短问答”转向“长时间无人值守的大任务”。

一句话看懂:Anthropic 发布 Claude Opus 5.5,针对越来越长、上下文越来越重的编码会话做成本优化,官方估算典型 token 计费工作负载下运行成本比 Opus 5 低约 40%。这背后是编码智能体用法正在从“短问答”转向“长时间无人值守的大任务”。

事件核心:发生了什么

Anthropic 于 2026 年 9 月 24 日发布 Claude Opus 5.5,定位明确:为编码会话优化成本。官方给出的关键调整有三项。

第一是价格。按 token 计费时,输入和输出 token 价格下调 20%,缓存读取(cache read)价格下调 60%。由于智能体编码任务中缓存读取占账单大头,这一项影响最大。官方称 Opus 5.5 的缓存 token 成本约为竞品模型的五分之一,同时性能表现更好。

第二是缓存命中率。Claude Code 在近半年做了多项改进,例如刷新登录、对话中途插入指令、按需加载工具等操作更不容易打断缓存,Opus 5.5、Fable 5.1 等新模型还支持会话中途切换 effort 等级而不重置缓存;API 和云服务用户可设置一小时缓存有效期,派生的子智能体可直接复用父级缓存。官方称未命中缓存的输入减少了 50% 以上。

第三是所需轮次更少。Anthropic 引用 Zeta Labs 的测试:同样任务下 Opus 5.5 的轮次和工具调用数少于 Opus 5,成本接近减半,最难任务完成量约翻倍。同时其输出生成速度比 Opus 5 快 30% 以上。

为什么重要

这组数据说明过去半年编码智能体的使用形态变了:每个 prompt 的工作时长增加 3.3 倍,每次 prompt 的模型调用次数增加 40% 以上,打断减少 68%,每次请求携带的上下文增长 2.6 倍,输入输出 token 比从 189:1 升到 324:1。

换句话说,账单结构正在从“生成答案”转向“反复读取上下文”。因此,谁能压低缓存读取成本、提高缓存命中率、减少无效轮次,谁就能在智能体编码这个高频付费场景里拿到价格优势。Anthropic 这次不是单纯降价,而是把定价、模型行为和 Claude Code 工程链路三件事一起调,属于针对自家产品形态做的成本工程。

对用户/开发者/创作者的影响

对按 token 付费的开发者,收益最大的场景是长时运行、高上下文的 Claude Code 会话,短任务本身轮次差不多,主要是单纯降价。可核查的观点来自 Addy 的分析:任务界定清晰时两个模型轮次接近,价差是全部收益;开放型任务差距最大,因为模型可能在错误方向上耗掉多轮。他提醒不要用一个数字套所有代码库,要自己测。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

实际使用上有两点值得注意:一是上下文工程直接决定账单,应尽量保证提供的上下文都是必要的,并让更多内容走缓存;二是缓存命中率比单次调用价格更值得监控,尤其对长时间无人值守的子智能体编排。

值得关注的后续

一是其他模型厂商是否跟进下调缓存读取价格,缓存经济性可能成为智能体编码竞争的新维度;二是 Claude Code 的缓存优化对非 Anthropic 模型是否同样生效,若只对新模型友好,会形成事实上的迁移压力;三是开放型长任务的成本优势能否在第三方基准上复现,目前公开信息显示主要来自官方与 Zeta Labs 的数据,独立验证仍然有限。

来源:Claude:Blog(网页)

celebrityanime
celebrityanime
文章: 25390

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注