At Box, we’ve been testing Sonnet 5.5 in early access on our complex work eval with the Box Agent, and Sonnet 5.5 is another strong jump from Sonnet 5 on knowledge work with enterprise content. Across the board we saw…

Anthropic 发布 Claude Sonnet 5.5,官方称比 Sonnet 5 快 30% 以上、成本最多降低 30%;Box 的早期测试显示其在企业知识工作任务上完成速度提升约 2.4 倍,且token消耗减少 12%。

一句话看懂:Anthropic 发布 Claude Sonnet 5.5,官方称比 Sonnet 5 快 30% 以上、成本最多降低 30%;Box 的早期测试显示其在企业知识工作任务上完成速度提升约 2.4 倍,且token消耗减少 12%。

事件核心:发生了什么

Anthropic 推出 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款模型,定位为 Sonnet 5 的明确升级版本:运行速度提升超过 30%,大多数任务成本最多下降 30%。

Box CEO Aaron Levie 同步披露了早期访问测试结果。Box 将 Sonnet 5.5 接入 Box Agent,在复杂企业内容工作评测中,最难测试项整体提升 4 个百分点,但交付完成的耗时约为此前的 1/2.4,token 用量还少了 12%。分行业看:金融服务提升 18 个百分点,法律 +7,生命科学 +8,公共部门 +7。

具体任务上差距更明显:金融服务的交易工具收购尽职调查中,Sonnet 5.5 找出了交易账簿里算错的利息总额和错误定价的期权,得分高出 48 个百分点,速度快约 61%;法律场景的商用租赁审查中,它拒绝编造“标准市场基准”,而是指出合同真正缺失的条款,提升 14 个百分点;生命科学领域从原始测量数据撰写田间试验报告,它把两个处理组的样本标准差都算对了,而 Sonnet 5 几乎全部算错,速度快约 41%;公共部门的数学干预项目报告,它从底层数据中取出了正确的学生进度监测数值,速度快约 71%。

为什么重要

这组数据的重点不在“更聪明”,而在“同等甚至更少 token 下更快交付”。企业级 AI 应用的瓶颈往往不是单次回答质量,而是多步骤任务的完成时长、token 成本和事实可靠性。Sonnet 5.5 在尽职调查、合同审查、试验数据统计这些容错率极低的场景里减少了“编造答案”的倾向,同时把速度和成本压下来,这对闭源大模型的商业化路线是一个直接验证:模型能力提升可以同时发生在效率维度,而不只是跑分维度。

此外,Box 明确表示客户很快可以在 Box AI Studio 中用 Sonnet 5.5 构建 AI 智能体,说明企业软件厂商正在把前沿模型直接嵌入工作流,而非停留在聊天入口。

对用户/开发者/创作者的影响

对开发者和企业采购方来说,速度与成本的双降会直接改变 API 选型:如果 Sonnet 5.5 在长链条任务中确实稳定,过去因推理成本而放弃的自动化流程(批量合同审查、财报核对、数据处理报告)可能重新变得可行。对内容与知识工作者,模型“拒绝编造、指出缺失”的行为比多写几百字更有价值,尤其在法律、金融、医疗等需要留痕和复核的领域。目前公开信息显示,Box AI Studio 的集成尚未上线,实际可用性和定价细节仍需等官方落地。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Box AI Studio 中 Sonnet 5.5 的实际开放时间和调用价格;二是官方宣称的“快 30%、省 30%”与第三方评测是否一致,尤其是长上下文和高并发场景;三是 GPT、Gemini 等竞品是否跟进同等幅度的性价比调整,以及企业侧会不会把这类模型纳入正式采购清单。

来源:Follow Builders · X · Aaron Levie

celebrityanime
celebrityanime
文章: 26227

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注