Anthropic抢在OpenAI开发者大会前甩出Claude Sonnet 5.5,一半价格逼近Opus、还通关了宝可梦

Anthropic 在 OpenAI 年度开发者大会前发布 Claude Sonnet 5.5,速度比上代 Sonnet 5 快约 30%、单任务成本降低最多 30%,定价只有 Opus 5.5 的一半,却在部分测试中接近甚至反超自家旗舰,还成为首个仅凭截图通关《宝可梦 红》的 Sonnet 模型。

一句话看懂:Anthropic 在 OpenAI 年度开发者大会前发布 Claude Sonnet 5.5,速度比上代 Sonnet 5 快约 30%、单任务成本降低最多 30%,定价只有 Opus 5.5 的一半,却在部分测试中接近甚至反超自家旗舰,还成为首个仅凭截图通关《宝可梦 红》的 Sonnet 模型。

事件核心:发生了什么

这款模型被 Anthropic 定位为”全能日常助手”,主打速度、低成本与高质量的平衡。根据公开信息,Sonnet 5.5 比上一代 Sonnet 5 提速约 30%,单任务成本最多下降 30%,价格是 Opus 5.5 的一半,但性能几乎持平;在 Terminal-Bench 4.0 等测试中,它甚至超过了自家更贵的旗舰模型。

更能说明问题的是游戏实测:Sonnet 5.5 是首个仅通过观察屏幕截图就完成《宝可梦 红》的 Sonnet 模型,没有使用内存修改或内置攻略,完全依靠视觉理解与长程规划逐帧推进剧情。此外,它支持五档 Effort Level 调节,低、中档适合日常任务、性价比高;但最高档开启后输出 token 量会大幅上升,成本可能反超 Opus 5.5,甚至出现性能下降。模型还加入了反蒸馏机制,并具备与 Opus 同级别的网络安全防护。

为什么重要

发布时间点很关键——紧贴 OpenAI 年度开发者大会之前,Anthropic 显然想在中端市场价格带上先占位。一直以来,”快、便宜、好”被视为难以同时满足的三角,Sonnet 5.5 试图用接近旗舰的表现、一半的价格来打破这个取舍。这对开发者 API 选型和整个中端大模型市场的定价权都会产生直接压力:当次旗舰能力逼近旗舰,企业采购和调用成本结构就要重新算账。反蒸馏与安全对齐的加码,也说明 Anthropic 在开放能力的同时,仍在强化自身模型资产的护城河。

对用户/开发者/创作者的影响

对开发者而言,Sonnet 5.5 是一个值得纳入默认候选的 API 选项:常规任务可用低、中档 Effort Level 控制 token 消耗,把预算留给真正复杂的推理环节;但要注意最高档并不等于最优,盲目拉满可能既费钱又掉效果。对办公、设计、3D 模拟等场景的用户,模型能力的覆盖面在扩大,视觉理解和长程规划的组合意味着能处理更连续的交互任务。对创作者和企业采购来说,在旗舰与次旗舰之间做取舍的空间变大,可以先用 Sonnet 5.5 验证工作流,再决定是否升级到 Opus。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是实际调用中 Effort Level 各档的成本与效果曲线,是否真如官方所述;二是 OpenAI 开发者大会是否给出针对性的价格或能力回应;三是反蒸馏与安全机制会不会影响第三方微调、集成和上线节奏。目前公开信息显示,这些细节仍需以官方文档和实测为准。

来源:AIbase

celebrityanime
celebrityanime
文章: 26214

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注