Anthropic将Claude Sonnet 5.5缓存读取价格减半,长任务成本约降20%

Anthropic 宣布把 Claude Sonnet 5.5 的缓存读取价格降到每百万 token 0.10 美元,相当于减半,并称这让大多数长时运行任务的成本下降约 20%。值得关注的是,它把降价瞄准了缓存读取这个特定环节,而非全面调价。

一句话看懂:Anthropic 宣布把 Claude Sonnet 5.5 的缓存读取价格降到每百万 token 0.10 美元,相当于减半,并称这让大多数长时运行任务的成本下降约 20%。值得关注的是,它把降价瞄准了缓存读取这个特定环节,而非全面调价。

事件核心:发生了什么

当地时间 2026 年 10 月 7 日,Claude 官方账号在 X 上发布消息称,将 Claude Sonnet 5.5 的缓存读取(cache reads)价格减半,调整后为每百万 token 0.10 美元。同一条推文还给出了一个量化说法:这一变化让 Sonnet 5.5 在多数长时运行工作负载上的运行成本大约便宜 20%。该信息由发布方以社交帖文形式给出,目前公开信息显示,Anthropic 尚未通过完整定价页文档进一步披露适用范围与生效细节。

与此同批发布的信息还包括 Claude Haiku 5.5 的上线,官方称其为目前最便宜、最快且能力最强的小型模型,运行成本平均比 Haiku 4.5 低约 75%,并首次在 Haiku 系列中引入可调 effort 设置,已在 AWS、Google Cloud 和 Microsoft Azure 等平台提供。

为什么重要

缓存读取是企业级 API 成本结构中的关键一环。在长对话、代码代理、文档问答等场景中,提示词缓存能避免重复处理相同上下文,缓存读取单价直接决定推理账单的底噪。把这一项价格压到每百万 token 0.10 美元,意味着用 Sonnet 5.5 跑长链路代理和持续上下文应用的边际成本被明显拉低。

更值得留意的是 Anthropic 的定价策略:它不是全面降价,而是选择性地下调高频复用部分的费用。这种打法对高频调用 API 的开发者更有吸引力,也有助于把 Sonnet 5.5 定位成长任务的主力模型,与 Haiku 5.5 覆盖的高并发、低成本短任务形成分层。在闭源大模型竞争仍围绕推理成本展开的当下,这类结构性调价可能比单纯发布新模型更能影响开发者的模型选型。

对用户/开发者/创作者的影响

对通过 API 构建 AI 应用的开发者来说,最直接的收益是缓存读取费用减半。凡是依赖长系统提示、固定知识库、长文档上下文或多轮代理循环的产品,单位请求成本都会下降;官方给出的约 20% 长任务降幅,可作为评估账单变化的参考量级,但实际节省取决于缓存命中率与上下文复用程度,并非所有请求都按同一比例下降。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

创作者和企业采购方需要区分两件事:Sonnet 5.5 面向长任务和较高质量需求,Haiku 5.5 面向高并发、成本敏感的摘要与分类等场景。如果原有流水线把重复上下文交给 Sonnet 处理,现在可以考虑把简单重复环节下放到 Haiku 5.5,把 Sonnet 5.5 留给真正需要更强推理的步骤,从而叠加两层成本优化。

值得关注的后续

一是价格变化的生效范围与时间:目前信息来自官方社交帖文,需关注 Anthropic 定价页是否同步更新,以及缓存写入价格是否也有调整。二是竞品是否跟进类似的结构性降价,尤其是缓存读取这一项,可能成为下一轮 API 定价竞争的焦点。三是长任务场景的实际成本验证:开发者可以按自身缓存命中率测算,判断号称约 20% 的降幅在真实工作负载中能兑现多少。

来源:X:Claude (@claudeai)

celebrityanime
celebrityanime
文章: 27937

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注