一句话看懂:Anthropic 于 2026 年 10 月 8 日发布轻量模型 Claude Haiku 5.5,API 百万 token 标价最低降至输入 0.10 美元、输出 0.50 美元,但新分词器会推高 token 用量,长文本任务实际降幅约 75%,并非账面 90%。
事件核心:发生了什么
Anthropic 正式上线 Claude 5.5 系列中的轻量型号 Claude Haiku 5.5。官方定价显示,单次请求在 10 万 token 以内的常规调用,输入和输出价格分别为每百万 token 0.10 美元和 0.50 美元,相比上一代标价下降约 90%。该模型主打高并发、低延迟和成本敏感场景,适用于实时客服、摘要提取、数据分类等高频调用任务。
功能上,Haiku 5.5 首次引入自适应思考与动态调节机制,可根据任务复杂度自动平衡推理深度与算力开销。不过官方同时提示,它采用与高级模型相同的新分词器,同一段文本切出的 token 数增加,实测长文本任务可能多消耗 25% 至 30% 的 token,因此综合考虑真实负载后,成本降幅约为 75%。此外,单次请求一旦超过 10 万 token 阈值,输入和输出单价都会跳涨至基础价的五倍。
为什么重要
这一定价策略把大模型 API 竞争进一步推向「标价低、实际用量高」的精细化阶段。轻量模型正在成为 AI 应用规模化落地的关键入口,价格战不再只是每百万 token 的数字对比,而是分词效率、上下文阈值和推理调度的综合较量。对 Anthropic 而言,Haiku 5.5 既是对 OpenAI 等竞品轻量线产品的直接回应,也是在闭源模型生态中争夺高频调用开发者的手段。新分词器统一到高级模型体系,也可能为后续模型间迁移和工具链复用铺路,但会改变开发者的成本测算方式。
对用户/开发者/创作者的影响
对开发者来说,评估 Haiku 5.5 时不能只看单价,需要把新分词器带来的 token 膨胀计入单位任务成本,并对超过 10 万 token 的长文档、长对话流程做拆分或压缩,否则容易触发五倍计费。做实时客服、分类和摘要类应用,可以优先小流量灰度测试真实账单。对内容创作者和企业采购而言,轻量模型适合批量处理,但长文生成和复杂推理仍要权衡 token 消耗与输出质量,目前公开信息显示官方并未给出具体质量评测数据。预算敏感团队可把 Haiku 5.5 纳入候选,但应以实际工作负载跑通账单后再决定是否迁移。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是新分词器是否会向 Claude 其他型号全面铺开,以及是否会提供 token 用量估算工具,帮助开发者提前核算成本。二是超过 10 万 token 后五倍计费的规则,是否会被竞品以更平滑的阶梯定价打破。三是社区和第三方评测能否给出 Haiku 5.5 在真实任务中的质量与成本对比,而不仅是官方标价。这些都将影响轻量模型 API 市场的下一步竞争。
来源:AIbase


