Claude Opus 5.5 登顶 Artificial Analysis Intelligence Index,并降价 20%

Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数上以 58 分登顶,同时把输入/输出价格下调 20%,缓存读取费用降幅达 60%。这意味着前沿模型的能力竞争正同步转向价格与成本效率的比拼。

Anthropic 发布 Claude Opus 5.5,在 Artificial Analysis 智能指数上以 58 分登顶,同时把输入/输出价格下调 20%,缓存读取费用降幅达 60%。这意味着前沿模型的能力竞争正同步转向价格与成本效率的比拼。

Anthropic 发布 Claude Opus 5.5,性能对标 Claude Fable 5.1,但典型工作负载成本比 Opus 5 低 40%,输出速度提升 30% 以上,这是其呼吁“放缓前沿模型竞赛”之后的首个新模型发布。

OpenAI 在 ChatGPT Work 和 Codex 中推送 GPT-6 Sol 与 GPT-6 Luna 两款新模型,付费用户先行,免费与 Go 用户可在桌面端试用 Luna。这是 GPT-6 系列首次进入实际产品线,也意味着模型分层策略进一步明确。

OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna 两款新模型并同步上线 API,官方称价格比 GPT-5.6 低 50%,其中 Luna 定价为每百万 token 输入 0.10 美元、输出 0.50 美元。

OpenAI 的两款新模型 GPT-6 Sol 和 GPT-6 Luna 已在第三方模型聚合平台 OpenRouter 上线,价格只有上一代 GPT-5.6 的一半,但在自动化任务基准 AutomationBench 上得分反而更高。

OpenAI 在 X 上发布 GPT-6 Sol 和 GPT-6 Luna 两款新模型,延续 GPT-6 Astra 的能力,但主打更快、更便宜,API 价格比 GPT-5.6 促销价还低 50%,同时优化了缓存和推理效率。

Arena 已上线 OpenAI 的 GPT-6 Sol 与 GPT-6 Luna 供用户实测,正式评分尚未公布;同期流出的对比视频把 GPT-6 Sol 与上一代 GPT-5.6 Sol 放在相同提示词、均开启最大推理的条件下比较,关注点不只是输出质量,还有 token 消耗与响应耗时。

Artificial Analysis 评测显示,OpenAI 的 GPT-6 Sol 和 Luna 把每百万 token 价格降到上一代约一半,推理成本明显下降,但知识与编程等评测出现有升有降,能力并非全面进步。

英国 AI 安全研究院(UK AISI)开始用 EvalEval 联盟的公开基础设施发布评测结果,首批覆盖 5 个基准测试、6 个前沿模型,让原本散落各处的跑分变成可复现、可对照的公共数据。

GitHub Copilot 在已上线的 GPT-6 Astra 之外,新增 GPT-6 Sol 和 GPT-6 Luna 两款模型,一个偏向多步验证的智能体编程,一个主打低成本快速任务。这意味着 Copilot 的模型选择开始按“任务档位”细分,而不只是拼最强能力。