一句话看懂:Anthropic 于 2026 年 10 月 8 日发布 Claude Haiku 5.5,官方称其运行成本较上一代 Haiku 4.5 平均降低约 75%,并首次在 Haiku 系列中加入可调节的推理强度。
事件核心:发生了什么
Anthropic 推出轻量级模型 Claude Haiku 5.5,定位是该公司速度最快、能力最强的小模型,主要面向文章摘要、内容分类、数据库查询、客服响应、浏览器自动化以及大型 AI 智能体拆解出的子任务等高频率、成本敏感场景。
价格方面,官方信息显示,10 万 token 单位以内的请求,输入和输出分别为每百万 token 0.1 美元和 0.5 美元,平均运营成本比 Haiku 4.5 下降约 75%。同时,Haiku 系列首次支持推理强度调节,用户可按任务轻重调整模型的思考深度,不必对每句话都支付满额算力。
Anthropic 还调整了 Sonnet 5.5 的缓存读取价格,将其减半至每百万 token 0.1 美元,官方称这能让多数智能体任务的运营成本降低约 20%。缓存读取是智能体反复查看长上下文时最常调用的部分。
为什么重要
小模型是当前大模型商业化落地的重要方向。Haiku 5.5 把成本压到更低,并开放推理强度控制,意味着开发者可以在精度和开销之间做更细的权衡,而不是只能二选一。这对依赖高频调用、利润空间有限的 AI 应用来说,直接影响单位经济模型。
缓存读取降价则指向另一个战场:智能体。长时间后台运行的智能体需要反复读取长上下文,缓存成本往往是隐藏开支。Sonnet 5.5 缓存价格减半,有助于降低这类持续运行任务的成本门槛,也可能推动更多团队尝试长时间运行的自动化流程。
对用户/开发者/创作者的影响
对开发者而言,最直接的变化是 API 调用成本下降,尤其是摘要、分类、查询改写、客服回复等轻量任务。可按任务调节推理强度,也让同一模型能兼顾简单请求和需要多步思考的场景,减少为简单任务浪费算力的情况。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对创作者和小型团队来说,更低成本意味着可以更大胆地把 AI 接入内容分类、素材整理和流程自动化,而不必每一步都担心 token 账单。不过,成本下降不等于能力自动满足所有需求,实际效果仍需结合具体任务验证。目前公开信息显示,Anthropic 未在素材中给出与竞品的横向评测数据。
值得关注的后续
第一,Haiku 5.5 的实际调用表现和稳定性是否达到官方描述,尤其是在推理强度调节下的输出质量变化。第二,Sonnet 5.5 缓存降价是否会被其他厂商跟进,进而影响智能体类产品的整体成本结构。第三,开发者生态是否会出现围绕低成本小模型和可调推理强度的新工具链与应用模式。
来源:AIbase


