一句话看懂:Anthropic 发布 Claude 5.5 系列轻量模型 Haiku 5.5,百万 token 输入价格降到 0.1 美元,但新分词器让长文本消耗增加约 25% 至 30%,实际降幅约 75%。
事件核心:发生了什么
2026 年 10 月 8 日,Anthropic 正式上线 Claude Haiku 5.5,这是 Claude 5.5 系列中定位轻量化的模型。官方定价显示,单次请求在 10 万 token 以内的常规调用,输入价格为每百万 token 0.1 美元,输出价格为每百万 token 0.5 美元,相比上一代标价下降约 90%。
Anthropic 同时提醒,Haiku 5.5 采用了与高阶模型相同的新分词器,同一段文本会切出更多 token。根据官方测试,长文本任务可能多消耗 25% 至 30% 的 token,因此计入实际用量后,整体成本降幅约为 75%。此外,单次请求一旦超过 10 万 token,输入和输出的单价都会跳涨至基础价格的 5 倍。
为什么重要
这一定价策略把轻量模型的价格竞争推到了新水平。对 Anthropic 来说,Haiku 5.5 主要瞄准高并发、低延迟和成本敏感的场景,包括实时客服、摘要提取和数据分类,与 OpenAI 等厂商的轻量模型形成直接对标。
但新分词器带来的隐性消耗也值得注意。标价下降不等于账单同比例下降,开发者需要重新估算 token 用量。尤其超过 10 万 token 后价格跳涨,说明 Anthropic 在用低价吸引高频短请求,同时对长上下文调用保留较高定价。
对用户/开发者/创作者的影响
对开发者而言,Haiku 5.5 适合把大量短请求放到低成本模型上跑,例如分类、抽取、客服回复初稿;但涉及长文档分析、代码库理解或大段上下文拼接时,要先用分词器估算实际 token 消耗,不能只看每百万 token 的标价。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对普通用户和创作者,目前公开信息显示,Haiku 5.5 还引入了自适应思考和动态调整能力,可根据任务复杂度自动平衡推理深度与算力成本。如果 API 调用方把这一能力接入内容摘要、素材归类等流程,单次任务的成本可能更低,但前提是控制好输入长度。
值得关注的后续
第一,实际计费是否与官方测试一致,尤其是中文、代码和长文档场景下的 token 膨胀幅度。第二,OpenAI、Google 等竞品是否跟进调整轻量模型价格或分词策略。第三,超过 10 万 token 后的高价档位是否会影响企业级长上下文应用的选型。
来源:AIbase


