Mistral Large 4 进入 Code Arena: WebDev 排名第45,得分1534

Mistral AI 的 Mistral Large 4 首次进入 Code Arena 的 WebDev 榜单,排在第 45 名、得分 1534,比上一代 Mistral Large 3 提升 304 分;它的性价比接近 Claude Opus 4.8,价格却只有约六分之一。

一句话看懂:Mistral AI 的 Mistral Large 4 首次进入 Code Arena 的 WebDev 榜单,排在第 45 名、得分 1534,比上一代 Mistral Large 3 提升 304 分;它的性价比接近 Claude Opus 4.8,价格却只有约六分之一。

事件核心:发生了什么

根据 Arena 在 X 上公布的信息,Mistral Large 4 正式登陆 Code Arena: WebDev 榜单,位列第 45 名,综合得分 1534。与 Mistral Large 3 相比,排名从第 130 名上升到第 45 名,得分提升 304 分;相较其表现次优的 Mistral Medium 3.5(第 122 名),则提升了 271 分。价格方面,Arena 给出的混合价格为每百万 token 3.47 美元,而 Claude Opus 4.8(High)约为 20 美元,后者得分仅高出 2 分。

Mistral AI 官方将它称为 “Le Chonk”:1T 参数、原生多模态、49B 激活参数,并强调它是美国或欧洲范围内聚合基准表现最好的开放权重模型,在网络安全、制造业和金融等关键负载上达到领先水平。官方同时表示,开放权重将在 10 月底发布。

为什么重要

这条榜单信息的价值不在排名本身,而在于它把”性能差距”和”价格差距”放在了同一张表上。Mistral Large 4 与 Claude Opus 4.8 只差 2 分,价格却接近 6 倍差距,说明头部闭源模型在 WebDev 这类编码任务上的性能溢价正在被压缩。Arena 也指出,附近有更强且更便宜的模型可选,因此它刚好落在 Pareto 前沿之外——换言之,它不是当前性价比最优解,但已经进入同一竞争区间。

另一个信号是开源路线。1T 参数、原生多模态、49B 激活的稀疏结构,加上 10 月底开放权重的承诺,意味着它有机会进入自托管和私有化部署场景,而不只是 API 调用。这对欧洲和美国市场强调数据主权的企业客户尤其有吸引力。

对用户/开发者/创作者的影响

对开发者来说,3.47 美元/百万 token 的价格让它在代码补全、Web 前端生成、批量脚本改写等高频调用场景里具备被认真评估的价值,尤其是成本敏感的团队。若 10 月底确实开放权重,自部署和微调的可能性会进一步降低长期使用成本,但要自行承担算力和推理工程开销。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对创作者和企业采购来说,可以把它视为”性能接近旗舰、价格明显更低”的备选项,但仍需注意 Arena 提示的”附近有更便宜且更强的模型”这一事实。是否选用,取决于具体任务的实测表现,而非单次榜单分数。

值得关注的后续

一是 10 月底开放权重是否按时落地,以及开源版本在 Arena 开放模型榜单上的实际得分。二是价格是否调整——若竞品在同等分数下继续下压价格,Mistral Large 4 的定位会被进一步挤压。三是它在网络安全、制造、金融等官方强调的关键负载上,是否有第三方可验证的独立评测数据。

来源:X:Arena (@arena)

celebrityanime
celebrityanime
文章: 27738

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注