Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index,并降价 20%

Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数上以 58 分登顶,同时把输入/输出价格下调 20%,缓存读取费用降幅达 60%。这意味着前沿模型的能力竞争正同步转向价格与成本效率的比拼。

一句话看懂:Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数上以 58 分登顶,同时把输入/输出价格下调 20%,缓存读取费用降幅达 60%。这意味着前沿模型的能力竞争正同步转向价格与成本效率的比拼。

事件核心:发生了什么

据 Artificial Analysis 在 X 上发布的信息,Claude Opus 5.5 在其 Intelligence Index 上取得 58 分,是该机构测得的最高分,领先此前纪录数个点。价格方面,输入/输出从 Opus 5 的每百万 token 5 美元/25 美元降至 4 美元/20 美元;5 分钟 TTL 的缓存写入从 6.25 美元降至 5 美元,缓存读取从 0.50 美元降至 0.20 美元,相当于未缓存输入价格的 95% 折扣。上下文窗口维持 100 万 token,支持图像与文本输入,并提供 low 到 max 五档 effort 设置。

为什么重要

这次发布的关键不只是“登顶”,而是 Anthropic 在能力与成本两个维度同时施压。在 Terminal-Bench 4.0 上,Opus 5.5 拿到 59.6%,与领先的 GPT-6 Astra 持平,比 Opus 5 提升 11 个百分点;在 AA-Briefcase 这一私有前沿知识工作评测中,其 Elo 达 1822,领先 Fable 5.1 达 143 分,也是 Anthropic 首次在呈现质量上超过 GPT-5.6 Sol。目前公开信息显示,它在 CritPt、AA-LCR、GDP.pdf 上仍略落后。更值得注意的是,Opus 5.5 每个智能指数任务输出约 119k token,是 Opus 5 的 1.6 倍,但单任务成本持平,且 max、xhigh、high、medium 四档都落在智能与单任务成本的帕累托前沿上——说明推理效率的改进抵消了更长输出带来的开销。

对用户/开发者/创作者的影响

对开发者而言,降价与缓存折扣直接改变 API 成本结构:高缓存命中率的应用(如长文档问答、代码库助手、多轮 agent 工作流)受益最明显,缓存读取仅为未缓存输入价格的 5%。五档 effort 设置也让开发者可以在延迟、质量和费用之间做更细的取舍,而不必在“最强模型”和“便宜模型”之间二选一。对企业和内容团队来说,AA-Briefcase 的高分意味着在专业报告、分析产出类任务上,Opus 5.5 的输出质量与排版呈现更接近可直接交付的水平,但代价是每任务输出 token 偏多,批量调用时仍需核算总成本。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 GPT-6 Astra 等竞品是否跟进降价或推出新版本,前沿模型的定价战是否进一步扩散;二是 Opus 5.5 在 CritPt、GDP.pdf 等落后项上能否通过后续更新补齐;三是五档 effort 在真实生产环境的成本表现,是否与评测中的帕累托前沿一致。

来源:X:Artificial Analysis (@ArtificialAnlys)

celebrityanime
celebrityanime
文章: 25072

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注