一句话看懂:Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,官方称其在几乎所有对齐评估中相较 Haiku 4.5 有重大提升,失准行为明显减少,同时运行成本约降低 75%。
事件核心:发生了什么
根据 Claude 官方 X 账号发布的信息,Claude Haiku 5.5 是 Anthropic 迄今最便宜、最快且能力最强的小模型。官方表示,其平均运行成本比 Haiku 4.5 低约 75%,在编程、computer use 和知识工作等任务上均有显著提升。Haiku 5.5 是首个支持可调 effort 设置的 Haiku 模型,用户可按任务在成本与智能之间取舍。该模型现已登陆 AWS、Google Cloud 和 Microsoft Azure 等平台。官方还提到,Haiku 5.5 在 10 万 token 以下任务中性价比尤其突出,这类请求约占此前 Haiku 模型使用量的 90%。
为什么重要
对齐评估改善与成本大幅下降同时出现,是这次发布最值得关注的两点。对大模型商业化而言,小模型通常承担高并发、低延迟、价格敏感的推理任务;如果官方数据成立,Haiku 5.5 有望在客服、分类、摘要等场景中替代部分更大模型调用,从而压低整体推理成本。另一方面,Anthropic 把对齐表现作为卖点,也说明安全与可控性正成为小模型竞争的差异化维度,而不再只是大模型旗舰版本的专属议题。目前公开信息显示,这些评测结论来自 Anthropic 自身发布,尚待第三方复现。
对用户/开发者/创作者的影响
对开发者来说,Haiku 5.5 的定位是子代理和批处理任务:官方称其可与 Claude Opus 5.5、Sonnet 5.5 搭配,在编程工作中承担子代理角色,也适合摘要、分类等高重复性任务。可调 effort 设置意味着 API 调用方能在成本和推理深度之间做更细粒度控制。对内容创作者和企业采购方,低成本小模型意味着更多自动化流程具备经济可行性,例如批量内容分类、实时客服和浏览器操作。此外,Anthropic 同时把 Sonnet 5.5 的缓存读取价格减半至每百万 token 0.10 美元,官方称这让 Sonnet 5.5 在多数长时任务中运行成本降低约 20%。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,Haiku 5.5 的对齐评测数据是否会有第三方独立验证,以及“失准行为减少”的具体指标和测试条件能否公开。第二,可调 effort 设置的实际效果如何,是否会在开发者社区形成稳定的成本优化实践。第三,竞品小模型是否会跟进降价或推出类似可调推理力度功能,进而影响 API 调用市场的价格结构。


