Claude Opus 5.5 登顶 Artificial Analysis 智能指数,得分 58

Anthropic 的 Claude Opus 5.5 在 Artificial Analysis 智能指数上以 58 分登顶,同时 API 价格下调 20%、缓存读取折扣扩大到 95%。

一句话看懂:Anthropic 的 Claude Opus 5.5 在 Artificial Analysis 智能指数上以 58 分登顶,同时 API 价格下调 20%、缓存读取折扣扩大到 95%。

事件核心:发生了什么

2026 年 9 月 22 日,第三方评测机构 Artificial Analysis 发布报告,Claude Opus 5.5 在其智能指数上取得 58 分,为目前测得的最高分。该模型在十项评测中的六项领先,包括 Humanity’s Last Exam(61.4%)、SciCode(66.9%)、GDPval-AA v2.1、AA-Briefcase v1.1、AA-Omniscience 和 AutomationBench-AA;在 Terminal-Bench 4.0 上得 59.6%,与 GPT-6 Astra 持平。价格方面,输入从每百万 token 5 美元降至 4 美元,输出从 25 美元降至 20 美元,缓存读取从 0.50 美元降至 0.20 美元。

为什么重要

这次更新的关键不只是跑分,而是 Anthropic 在两个方向同时推进:一是把智能上限抬高,二是把单位成本压低。Opus 5.5 的五个努力档位中有四个落在“智能 vs 单任务成本”的帕累托前沿上,意味着它不靠堆算力换分数。同时,它在 AA-Briefcase 这类智能体知识工作上拿到 1822 Elo,领先 Fable 5.1 达 143 分,并在展示质量上首次超过 GPT-5.6 Sol。这表明 Anthropic 正在 agentic 场景中建立对 OpenAI 的差异化优势,而不只是通用能力对齐。

对用户/开发者/创作者的影响

对开发者而言,缓存读取折扣从 90% 扩到 95%,对频繁调用长上下文、检索增强或智能体循环的应用是直接降本。一个值得注意的细节是:Opus 5.5 在最高档位下单任务输出约 119k token,高于 Opus 5 的约 73k,但单任务成本与 Opus 5 持平,说明效率提升抵消了 token 增长。创作者和企业采购可以按五档努力设置灵活权衡质量与支出,而不必在“用最强模型”和“控制预算”之间二选一。目前公开信息显示,100 万 token 上下文窗口和图文输入能力维持不变。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 GPT-6 Astra 和 Fable 系列是否会在短期内跟进降价或推出新档位;二是 Opus 5.5 在 CritPt、AA-LCR、GDP.pdf 三项上仍落后,后续能否补齐;三是缓存折扣和努力档位的组合在真实 agent 工作流中的成本表现,是否与评测环境一致。

来源:Artificial Analysis 完整文章(网页)

celebrityanime
celebrityanime
文章: 25045

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注