Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 Token 0.10 美元

Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,将 1M 上下文小模型的输入价格压到每百万 Token 0.10 美元,短上下文定价比 Haiku 4.5 低约 90%,定位是 Opus 5.5 和 Sonnet 5.5 之下的高吞吐子智能体。

一句话看懂:Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,将 1M 上下文小模型的输入价格压到每百万 Token 0.10 美元,短上下文定价比 Haiku 4.5 低约 90%,定位是 Opus 5.5 和 Sonnet 5.5 之下的高吞吐子智能体。

事件核心:发生了什么

Haiku 5.5 是 Anthropic 目前最便宜、最快的小模型,支持 1M Token 上下文和最高 128K 输出 Token,知识截止 2026 年 6 月,可处理文本和图像输入。它已通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 正式提供。

定价分两档:100K Token 以内,输入每百万 0.10 美元、输出 0.50 美元;超过 100K 后升至输入 0.50 美元、输出 2.50 美元。缓存读取每百万 0.01 美元,批处理再打五折。作为对比,Haiku 4.5 的输入和输出分别为 1 美元和 5 美元。Anthropic 称,大约 90% 的 Haiku 4.5 请求在 100K Token 以内,考虑新分词器约多计 30% Token 后,Haiku 5.5 平均便宜约 75%。

为什么重要

这延续了小模型“降价扩量”的竞争路线。Haiku 5.5 短上下文列表价与 GPT-6 Luna 相同,但超过 100K 后更贵;Luna 的高价档从 272K Token 才触发,因此在 150K Token 场景下 Luna 列表价更低。Anthropic 公布的评测中,Haiku 5.5 在 OSWorld 2.1 离线子集得分 72.4%,Haiku 4.5 为 15.7%;Terminal-Bench 4.0 为 39.2%,Haiku 4.5 为 0.0%。这些数字均为 Anthropic 自报,且限于所标注任务和条件,不应视为永久排名。Sonnet 5.5 在所有列出的评测中仍领先,Anthropic 自身也建议复杂智能体编码使用 Sonnet 5.5 或 Opus 5.5。

对用户/开发者/创作者的影响

最适合三类工作负载:作为 Opus 5.5 或 Sonnet 5.5 下的子智能体执行局部任务,例如 Rogo 用它提取 10-K 财报中的收入行;高吞吐文档问答与摘要,AlphaSense 表示其在一项功能上每周处理约 800 万次调用;以及对速度敏感的实时客服和浏览器任务。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

开发者需要注意两项迁移成本:非默认的 temperature、top_p 或 top_k 值会返回 400 错误;新分词器对同一段文本的计量比 Haiku 4.5 多约 30%。此外,Haiku 5.5 是首个带可调 effort 设置的 Haiku 级模型,自适应思考默认开启,effort 默认 medium。

值得关注的后续

第一,Haiku 5.5 在真实子智能体编排中的成本优势能否兑现,尤其考虑到分词器差异和高频调用叠加后的实际账单。第二,OpenAI 是否调整 GPT-6 Luna 在 100K 至 272K 区间的定价,以回应 Haiku 5.5 的短上下文策略。第三,Haiku 5.5 的计算机使用 SDK 目前处于 beta,其正式上线时间和生态支持范围值得跟踪。

来源:MarkTechPost Research

celebrityanime
celebrityanime
文章: 28212

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注