一句话看懂:Anthropic 于 2026 年 10 月 7 日发布 Claude Haiku 5.5,这是其目前最便宜、最快的小模型,支持 1M Token 上下文,短上下文输入定价为每百万 Token 0.10 美元,定位高并发子代理、摘要与分类任务。
事件核心:发生了什么
根据 MarkTechPost Research 的报道,Anthropic 正式推出 Claude Haiku 5.5。它延续了 Haiku 系列的小模型定位,面向摘要、压缩、分类和子代理等高吞吐场景,保留 1M Token 上下文窗口和最高 128K 输出 Token。价格采用两档结构:提示在 100K Token 以内时,输入每百万 Token 0.10 美元、输出 0.50 美元;超过 100K 后分别升至 0.50 美元和 2.50 美元。缓存读取为每百万 0.01 美元,批量处理可再享五折。
新模型已通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 正式提供。这是首个支持可调努力程度的 Haiku 级模型,自适应思考默认开启,effort 参数默认为 medium。Anthropic 同时提醒,非默认的 temperature、top_p、top_k 会返回 400 错误,且新分词器对同一文本的计数比 Haiku 4.5 多约 30%。官方称,在计入分词器变化后,Haiku 5.5 平均约便宜 75%。
为什么重要
Haiku 5.5 把“小模型”的竞争焦点从单纯便宜推向了可用的代理能力。Anthropic 报告的基准显示,它在 OSWorld 2.1 离线子集上达到 72.4%,远高于 Haiku 4.5 的 15.7%;Terminal-Bench 4.0 为 39.2%,而 Haiku 4.5 为 0.0%。这些数据目前仅为 Anthropic 自报,且来自特定评测条件,不代表长期排名。更关键的是,它把短上下文价格压到与 GPT-6 Luna 相同,给高频调用类 AI 应用提供了更低的试错成本,但超过 100K Token 后定价明显上浮,长上下文场景的性价比仍取决于具体使用方式。
对用户/开发者/创作者的影响
对开发者而言,Haiku 5.5 更适合作为 Opus 5.5 或 Sonnet 5.5 之下的子代理,承担文档问答、摘要、分类和速度敏感型任务,而不是领衔复杂代理编码。批量折扣、缓存读取低价和 128K 输出上限,有利于构建高并发后台流程。需要注意的是,迁移时要处理分词器差异和采样参数限制,否则可能遇到错误或成本偏差。对企业和创作者来说,如果应用主要处理 100K Token 以内的内容,调用成本会明显下降;但长文档、长对话场景应重新评估账单,因为超过阈值后输入输出单价分别上涨到 0.50 美元和 2.50 美元。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,观察非 Anthropic 来源的独立评测,验证 OSWorld、Terminal-Bench 等成绩在真实任务中的可复现性。第二,关注 GPT-6 Luna 和 Gemini 3.5 Flash-Lite 是否调整长上下文定价或能力,尤其 100K 附近的价格分档。第三,留意开发者迁移反馈,特别是分词器变化和采样参数限制是否影响现有生产管线。目前公开信息显示,Haiku 5.5 已可部署,但实际体验仍待更多第三方数据补充。


