一句话看懂:Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,并同步登陆 AWS、Google Cloud 和 Microsoft Azure。官方称其运行成本比 Haiku 4.5 平均低约 75%,是面向高频、成本敏感场景的小模型升级。
事件核心:发生了什么
据 Claude 官方 X 账号发布的信息,Haiku 5.5 已在所有平台开放,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。Anthropic 称这是其迄今最便宜、最快、能力最强的小模型,平均运行成本较 Haiku 4.5 降低约 75%。在编码、computer use 和知识工作三类任务上,官方表示相对 Haiku 4.5 有明显提升。
此次更新还引入可调节的 effort 设置,允许开发者按任务在成本与智能之间取舍。官方特别提到,该模型在 10 万 token 以下任务中性价比突出,而这类请求约占此前 Haiku 模型总请求量的 90%。同批更新中,Claude Sonnet 5.5 的缓存读取价格被下调一半,至每百万 token 0.10 美元。
为什么重要
小模型赛道的竞争焦点正在从“能不能用”转向“单位成本能跑多少活”。Haiku 5.5 直接锁定高并发、重复性任务,与 Opus 5.5、Sonnet 5.5 形成分层:大模型负责复杂推理,小模型作为 subagent 承担编码等环节的细碎工作。这类组合如果成立,会进一步压低企业部署 AI 应用的门槛,也让 API 定价成为厂商间更直接的竞争维度。
对用户/开发者/创作者的影响
对开发者而言,Haiku 5.5 最现实的用途是摘要、分类、客服回复和浏览器操作等高频调用场景,成本下降意味着同样预算可支撑更多请求。可调节 effort 设置则让团队按任务粒度控制开销,而不必整体切换模型。对使用多云架构的团队,AWS、Google Cloud、Azure 同步可用减少了接入摩擦。创作者和企业采购方可关注其与 Sonnet 5.5 缓存降价叠加后的整体账单变化。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 Haiku 5.5 的实际评测数据是否与官方说法一致,尤其是编码和 computer use 任务;二是可调节 effort 在真实工作流中的成本与效果曲线;三是 Sonnet 5.5 缓存降价是否引发其他厂商跟进,以及小模型 API 价格战是否继续下探。


