Claude Haiku 5.5 发布:对齐评测大幅改善,运行成本降约75%

Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,官方称其在几乎所有对齐评估中相较 Haiku 4.5 有重大提升,失准行为明显减少,同时运行成本约降低 75%。

一句话看懂:Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,官方称其在几乎所有对齐评估中相较 Haiku 4.5 有重大提升,失准行为明显减少,同时运行成本约降低 75%。

事件核心:发生了什么

根据 Claude 官方 X 账号发布的信息,Claude Haiku 5.5 是 Anthropic 迄今最便宜、最快且能力最强的小模型。官方表示,其平均运行成本比 Haiku 4.5 低约 75%,在编程、computer use 和知识工作等任务上均有显著提升。Haiku 5.5 是首个支持可调 effort 设置的 Haiku 模型,用户可按任务在成本与智能之间取舍。该模型现已登陆 AWS、Google Cloud 和 Microsoft Azure 等平台。官方还提到,Haiku 5.5 在 10 万 token 以下任务中性价比尤其突出,这类请求约占此前 Haiku 模型使用量的 90%。

为什么重要

对齐评估改善与成本大幅下降同时出现,是这次发布最值得关注的两点。对大模型商业化而言,小模型通常承担高并发、低延迟、价格敏感的推理任务;如果官方数据成立,Haiku 5.5 有望在客服、分类、摘要等场景中替代部分更大模型调用,从而压低整体推理成本。另一方面,Anthropic 把对齐表现作为卖点,也说明安全与可控性正成为小模型竞争的差异化维度,而不再只是大模型旗舰版本的专属议题。目前公开信息显示,这些评测结论来自 Anthropic 自身发布,尚待第三方复现。

对用户/开发者/创作者的影响

对开发者来说,Haiku 5.5 的定位是子代理和批处理任务:官方称其可与 Claude Opus 5.5、Sonnet 5.5 搭配,在编程工作中承担子代理角色,也适合摘要、分类等高重复性任务。可调 effort 设置意味着 API 调用方能在成本和推理深度之间做更细粒度控制。对内容创作者和企业采购方,低成本小模型意味着更多自动化流程具备经济可行性,例如批量内容分类、实时客服和浏览器操作。此外,Anthropic 同时把 Sonnet 5.5 的缓存读取价格减半至每百万 token 0.10 美元,官方称这让 Sonnet 5.5 在多数长时任务中运行成本降低约 20%。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一,Haiku 5.5 的对齐评测数据是否会有第三方独立验证,以及“失准行为减少”的具体指标和测试条件能否公开。第二,可调 effort 设置的实际效果如何,是否会在开发者社区形成稳定的成本优化实践。第三,竞品小模型是否会跟进降价或推出类似可调推理力度功能,进而影响 API 调用市场的价格结构。

来源:Follow Builders · X · Claude

celebrityanime
celebrityanime
文章: 28372

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注