Boris Cherny 实测 Claude Opus 5.5:比 Fable 5.1 快且便宜 51%

Anthropic 发布 Claude Opus 5.5,官方称多数任务上达到 Fable 5.1 的水平,运行成本比 Opus 5 低 40%;开发者 Boris Cherny 用同一项 C 转 Rust 工程实测后,称其比 Fable 5.1 更快、且便宜 51%。

一句话看懂:Anthropic 发布 Claude Opus 5.5,官方称多数任务上达到 Fable 5.1 的水平,运行成本比 Opus 5 低 40%;开发者 Boris Cherny 用同一项 C 转 Rust 工程实测后,称其比 Fable 5.1 更快、且便宜 51%。

事件核心:发生了什么

Anthropic 推出 Claude 5.5 家族的首个模型 Claude Opus 5.5,官方给出的定位是:在大多数任务上对标 Claude Fable 5.1,同时运行成本比 Opus 5 低 40%。

比官方参数更有参考价值的是开发者 Boris Cherny 的实测。他把 Opus 5.5 和 Fable 5.1 分别用于同一个项目——把 HAProxy 从 C 语言移植到 Rust。两者都通过了 HAProxy 几乎全部的测试用例,但 Opus 5.5 用时 9.5 小时,Fable 5.1 用时 12 小时,且 Opus 5.5 的成本低 51%。Cherny 表示,过去几周 Opus 5.5 已是他的日常主力模型。

为什么重要

这次发布的关键词不是“更强”,而是“同等水平、更便宜、更快”。在大模型能力逐渐接近的当下,价格与推理效率正在成为厂商竞争的主战场。官方口径的 40% 降本,加上第三方实测 51% 的成本差,说明 Anthropic 在推理侧的优化已经能直接反映到账单上。

另一个信号是任务类型:C 转 Rust 属于典型的长周期、强工程约束的代码迁移任务,对上下文长度、工具调用稳定性和错误自我修正能力要求都很高。这类任务能跑通并完整通过测试套件,说明模型的能力已经从“写代码片段”走向“承担可交付的工程工作”。目前公开信息显示,这仍是单点测试,不能等同于所有生产场景下的表现。

对用户/开发者/创作者的影响

对开发者而言,最直接的变化是成本结构。代码迁移、重构、批量测试修复这类原本因 token 消耗高而不敢大规模交给模型的任务,现在有了更现实的投入产出比。Cherny 的案例提供了一个可复用的判断方式:不要只看模型跑分,而是拿自己真实的迁移或重构任务做一次对照实验,比较完成时间、测试通过率和总花费。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对企业采购来说,模型选型从“谁最强”转向“单位任务成本最低”,这会推动更多团队采用多模型策略,把高难度任务和批量任务分流到不同价位的 API 上。对内容创作者,影响相对间接,主要体现为支持长任务的工具类产品可能变便宜、变快。

值得关注的后续

一是 Opus 5.5 的定价与 API 是否正式开放、是否有速率或上下文限制;二是 Fable 5.1 或其他竞品是否会跟进降价或推出对标模型;三是社区能否复现 Cherny 的测试结果,尤其是不同代码库规模下的成本差异是否稳定。若第三方复现一致,“同等能力、更低成本”很可能成为下一轮模型发布的默认叙事。

来源:X:Boris Cherny (@bcherny)

celebrityanime
celebrityanime
文章: 25045

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注