Claude Haiku 5.5价格降90%,但新分词器推高实际消耗

Anthropic 发布 Claude 5.5 系列轻量模型 Haiku 5.5,百万 token 输入价格降到 0.1 美元,但新分词器让长文本消耗增加约 25% 至 30%,实际降幅约 75%。

一句话看懂:Anthropic 发布 Claude 5.5 系列轻量模型 Haiku 5.5,百万 token 输入价格降到 0.1 美元,但新分词器让长文本消耗增加约 25% 至 30%,实际降幅约 75%。

事件核心:发生了什么

2026 年 10 月 8 日,Anthropic 正式上线 Claude Haiku 5.5,这是 Claude 5.5 系列中定位轻量化的模型。官方定价显示,单次请求在 10 万 token 以内的常规调用,输入价格为每百万 token 0.1 美元,输出价格为每百万 token 0.5 美元,相比上一代标价下降约 90%。

Anthropic 同时提醒,Haiku 5.5 采用了与高阶模型相同的新分词器,同一段文本会切出更多 token。根据官方测试,长文本任务可能多消耗 25% 至 30% 的 token,因此计入实际用量后,整体成本降幅约为 75%。此外,单次请求一旦超过 10 万 token,输入和输出的单价都会跳涨至基础价格的 5 倍。

为什么重要

这一定价策略把轻量模型的价格竞争推到了新水平。对 Anthropic 来说,Haiku 5.5 主要瞄准高并发、低延迟和成本敏感的场景,包括实时客服、摘要提取和数据分类,与 OpenAI 等厂商的轻量模型形成直接对标。

但新分词器带来的隐性消耗也值得注意。标价下降不等于账单同比例下降,开发者需要重新估算 token 用量。尤其超过 10 万 token 后价格跳涨,说明 Anthropic 在用低价吸引高频短请求,同时对长上下文调用保留较高定价。

对用户/开发者/创作者的影响

对开发者而言,Haiku 5.5 适合把大量短请求放到低成本模型上跑,例如分类、抽取、客服回复初稿;但涉及长文档分析、代码库理解或大段上下文拼接时,要先用分词器估算实际 token 消耗,不能只看每百万 token 的标价。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对普通用户和创作者,目前公开信息显示,Haiku 5.5 还引入了自适应思考和动态调整能力,可根据任务复杂度自动平衡推理深度与算力成本。如果 API 调用方把这一能力接入内容摘要、素材归类等流程,单次任务的成本可能更低,但前提是控制好输入长度。

值得关注的后续

第一,实际计费是否与官方测试一致,尤其是中文、代码和长文档场景下的 token 膨胀幅度。第二,OpenAI、Google 等竞品是否跟进调整轻量模型价格或分词策略。第三,超过 10 万 token 后的高价档位是否会影响企业级长上下文应用的选型。

来源:AIbase

celebrityanime
celebrityanime
文章: 28212

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注