一句话看懂:Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数上以 58 分登顶,同时把输入/输出价格下调 20%,缓存读取费用降幅达 60%。这意味着前沿模型的能力竞争正同步转向价格与成本效率的比拼。
事件核心:发生了什么
据 Artificial Analysis 在 X 上发布的信息,Claude Opus 5.5 在其 Intelligence Index 上取得 58 分,是该机构测得的最高分,领先此前纪录数个点。价格方面,输入/输出从 Opus 5 的每百万 token 5 美元/25 美元降至 4 美元/20 美元;5 分钟 TTL 的缓存写入从 6.25 美元降至 5 美元,缓存读取从 0.50 美元降至 0.20 美元,相当于未缓存输入价格的 95% 折扣。上下文窗口维持 100 万 token,支持图像与文本输入,并提供 low 到 max 五档 effort 设置。
为什么重要
这次发布的关键不只是“登顶”,而是 Anthropic 在能力与成本两个维度同时施压。在 Terminal-Bench 4.0 上,Opus 5.5 拿到 59.6%,与领先的 GPT-6 Astra 持平,比 Opus 5 提升 11 个百分点;在 AA-Briefcase 这一私有前沿知识工作评测中,其 Elo 达 1822,领先 Fable 5.1 达 143 分,也是 Anthropic 首次在呈现质量上超过 GPT-5.6 Sol。目前公开信息显示,它在 CritPt、AA-LCR、GDP.pdf 上仍略落后。更值得注意的是,Opus 5.5 每个智能指数任务输出约 119k token,是 Opus 5 的 1.6 倍,但单任务成本持平,且 max、xhigh、high、medium 四档都落在智能与单任务成本的帕累托前沿上——说明推理效率的改进抵消了更长输出带来的开销。
对用户/开发者/创作者的影响
对开发者而言,降价与缓存折扣直接改变 API 成本结构:高缓存命中率的应用(如长文档问答、代码库助手、多轮 agent 工作流)受益最明显,缓存读取仅为未缓存输入价格的 5%。五档 effort 设置也让开发者可以在延迟、质量和费用之间做更细的取舍,而不必在“最强模型”和“便宜模型”之间二选一。对企业和内容团队来说,AA-Briefcase 的高分意味着在专业报告、分析产出类任务上,Opus 5.5 的输出质量与排版呈现更接近可直接交付的水平,但代价是每任务输出 token 偏多,批量调用时仍需核算总成本。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 GPT-6 Astra 等竞品是否跟进降价或推出新版本,前沿模型的定价战是否进一步扩散;二是 Opus 5.5 在 CritPt、GDP.pdf 等落后项上能否通过后续更新补齐;三是五档 effort 在真实生产环境的成本表现,是否与评测中的帕累托前沿一致。


