Claude Haiku 5.5发布:成本降75%,Sonnet 5.5缓存读取降价一半

Anthropic 推出 Claude Haiku 5.5,号称迄今最快、最便宜的小模型,运行成本比 Haiku 4.5 平均降低约 75%,同时 Sonnet 5.5 缓存读取价格减半,面向高并发、成本敏感场景。

一句话看懂:Anthropic 推出 Claude Haiku 5.5,号称迄今最快、最便宜的小模型,运行成本比 Haiku 4.5 平均降低约 75%,同时 Sonnet 5.5 缓存读取价格减半,面向高并发、成本敏感场景。

事件核心:发生了什么

2026 年 10 月 7 日,Anthropic 发布 Claude Haiku 5.5。官方称这是其“最便宜、最快、能力最强的小模型”,主要面向高频、成本敏感的任务,如摘要、压缩、数据库查询和分类,也适合作为 Opus 5.5、Sonnet 5.5 在编程任务中的子代理,以及实时客服、浏览器操作等速度敏感场景。

价格方面,Haiku 5.5 较 Haiku 4.5 平均便宜约 75%。同步调整的还有 Claude Sonnet 5.5:缓存读取价格减半,官方称在大多数智能体任务上运行成本降低约 20%。此外,Anthropic 为 Claude Max 和 Team 订阅用户新增月度 API 额度,用于在 Claude 平台上构建新代理和应用。

基准测试方面,Haiku 5.5 在 GDPval-AA v2.1 知识工作评测中得 1620 分(Haiku 4.5 为 735,GPT-6 Luna 为 1437,Sonnet 5.5 为 1840);OSWorld 2.1 计算机使用离线子集得分 72.4%(Haiku 4.5 为 15.7%)。它还首次在 Haiku 级模型中引入可调节的 effort 设置,让用户自行权衡成本与智能水平。

为什么重要

Haiku 5.5 的发布延续了小模型“够用就好、成本优先”的路线。对 Anthropic 而言,这不仅是补全 Opus 5.5、Sonnet 5.5 之下的产品梯队,也是在和企业级低价模型(如 GPT-6 Luna)正面争夺高并发 API 市场。将 Haiku 作为子代理配合大模型,可以在智能体工作流中把简单重复环节分流到低成本模型,控制整体推理成本。

Sonnet 5.5 缓存读取降价同样值得注意:缓存成本通常是智能体长上下文应用的主要开支之一,减半有助于降低多轮调用、工具链反复读取上下文的门槛。新增的 Max/Team 月度 API 额度,则更像是用来绑定订阅用户、鼓励开发者把代理应用留在 Claude 平台上的生态动作。

对用户/开发者/创作者的影响

对开发者来说,Haiku 5.5 适合把分类、摘要、查询改写等高频低难度调用从大模型迁移过来,单次成本的大幅下降会直接影响 API 账单。可调节 effort 让同一模型可以在“便宜快速”和“更聪明但更贵”之间切换,便于按任务分层设计。配合 Sonnet 5.5 缓存降价,多步代理和长上下文应用的边际成本也有望降低。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业和创作者,实时客服、浏览器自动化、内容初筛等场景可以优先评估 Haiku 5.5。但需注意,这些基准结果有明确的任务和评测条件限制,并不等于在所有生产环境中都保持同等优势,实际选型仍应结合自身数据和延迟要求测试。

值得关注的后续

一是 Haiku 5.5 的实际 API 定价与限流政策何时全面开放,以及 effort 设置对计费的具体影响。二是 Sonnet 5.5 缓存降价后,是否会有更多竞品跟进类似的价格调整。三是 Max/Team 月度 API 额度的具体额度、有效期与使用范围,将决定它能否真正带动开发者在 Claude 平台上构建代理应用。

来源:www.anthropic.com

celebrityanime
celebrityanime
文章: 27937

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注