Claude Opus 5.5 发布:一天内迁移 68 万行代码,单任务成本比 GPT-6 Astra 便宜 80%

Anthropic 发布 Claude Opus 5.5,主打编程与知识工作效率,称典型任务成本比 Opus 5 降低约 40%,每项任务的调用成本最低只有 GPT-6 Astra 的 20%。

一句话看懂:Anthropic 发布 Claude Opus 5.5,主打编程与知识工作效率,称典型任务成本比 Opus 5 降低约 40%,每项任务的调用成本最低只有 GPT-6 Astra 的 20%。

事件核心:发生了什么

9 月 22 日,Anthropic 发布 Claude Opus 5.5,这是 Claude 5.5 系列首款模型,距上一代 Opus 5 仅约两个月。官方称其在多数工作中的表现已接近 Claude Fable 5.1,但典型任务运行成本降低约 40%。

API 输入价格从每百万 Token 5 美元降至 4 美元,输出从 25 美元降至 20 美元,均下降 20%;缓存读取从 0.5 美元降至 0.2 美元,降幅 60%。输出速度提升 30% 以上。Anthropic 强调,40% 的成本降幅来自更少步骤与 Token 完成任务的叠加效果,而非单纯的单价下调。

能力侧,Anthropic 披露一名早期测试者用 Opus 5.5 在不到一天内完成 68 万行代码迁移,若手动处理可能需数周;在 FrontierCode 默认工作量下,单任务成本约为 GPT-6 Astra 的 20%,Terminal Bench 4.0 中约为 Astra 的 40% 且性能持平。

为什么重要

这是 Anthropic CEO Dario Amodei 提出“放慢前沿”后发布的首款大模型。方向已不再是单纯堆规模,而是把编程、计算机操作、知识工作的完成质量和总成本放在同一叙事里。Anthropic 一方面称 Opus 5.5 为新主力模型,另一方面主动弱化跑分解释力,转向任务完成率、修改范围和长期协作体验。

对行业来说,竞争单位正在从“每百万 Token 多少钱”转向“完成一个真实任务需要多少钱”。这对需要反复读代码库、调用工具、跑测试的 Coding Agent 尤其明显——缓存读取往往占大头,60% 的缓存降价带来的实际节省可能高于表面的输入输出降价。

对用户/开发者/创作者的影响

开发者侧最直接的变化是成本结构。如果工作流大量依赖缓存读取,实际账单下降幅度会接近 40% 而非 20%。Pro、Max、Team 和按席位计费的 Enterprise 计划已提高五小时使用额度,订阅用户还可保存一次额度重置机会。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

知识工作与财务分析场景也有数据:在 GDPval-AA v2.1 中 Elo 得分 1846,领先 Fable 5.1 和 Opus 5;投资公司 Walleye Capital 报告称其在最低设置下基本解决评估套件问题,甚至发现并修正了评估说明中的错误。

需要注意的是能力并非完全开放。Anthropic 认为 Opus 5.5 在生物学和网络安全方面已与 Claude Mythos 5.1 相当,因此部署了类似 Fable 5.1 的安全措施,高风险任务如二进制漏洞挖掘、生物武器相关信息需通过组织和人员验证。

值得关注的后续

一是 Sonnet 5.5 和 Haiku 5.5 预计未来几周发布,效率与安全改进是否会下放到中端和轻量模型;二是缓存降价能否真正传导到第三方 AI 应用和 Agent 产品的定价;三是外部评估机构 Frontier Design、METR 的测试结果是否会公开,以及验证计划对开发者生态的实际门槛。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 25234

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注