JetBrains发布Mellum2.1编程AI模型,高负载吞吐量达Qwen3.5-9B两倍

JetBrains 正式推出编程 AI 模型 Mellum2.1,延续 12B 混合专家架构和开源许可,重点强化智能体编程能力,官方测试显示高负载场景下 Token 吞吐量接近 Qwen3.5-9B 的两倍。

一句话看懂:JetBrains 正式推出编程 AI 模型 Mellum2.1,延续 12B 混合专家架构和开源许可,重点强化智能体编程能力,官方测试显示高负载场景下 Token 吞吐量接近 Qwen3.5-9B 的两倍。

事件核心:发生了什么

2026 年 10 月 9 日,开发工具厂商 JetBrains 发布新一代编程 AI 模型 Mellum2.1。该模型继续采用 120 亿参数的混合专家(MoE)架构,并保持开源许可,官方称此举意在降低企业和个人开发者私有化部署的门槛。

与上一代相比,Mellum2.1 最大的训练变化是把强化学习从原来的短期结论阶段扩展为核心训练组件,并在数百万个软件工程与算法沙盒环境中完成了专项强化。官方表示,升级后的模型具备较强的自检索与验证能力,能识别测试失败的根因并起草修复方案。此外,得益于多 Token 预测技术,模型在单次请求场景下响应速度提升约 1.6 倍;在高负载推理请求下,Token 吞吐量接近热门开源模型 Qwen3.5-9B 的两倍。

为什么重要

对编程 AI 赛道而言,Mellum2.1 的发布释放了两个信号。其一,强化学习正在从“锦上添花”变成编程模型训练的主干,这意味着模型不只是补全代码,而是更接近能自主检索、验证和修复的智能体。其二,JetBrains 选择开源路线,直接对标 Qwen 系列等开源编程模型,企业私有部署市场可能迎来更激烈的性价比竞争。目前公开信息显示,官方对比数据仅覆盖吞吐量和响应速度,并未披露完整基准测试排名,因此“两倍”这一结论应限定在高负载 Token 吞吐这一特定条件下理解。

对用户/开发者/创作者的影响

对使用 JetBrains IDE 的开发者来说,Mellum2.1 如果集成进现有工具链,最直接的变化是代码补全、测试修复和智能体任务执行的响应速度可能更快,尤其在团队并发调用或 CI 流水线中,吞吐量提升比单次延迟更有价值。对企业和私有部署团队而言,开源许可加上 MoE 架构意味着可以在自有算力上运行,数据不出内网,成本可控性更高。对 AI 应用开发者,模型若提供 API 或本地推理接口,可作为编程类 Agent 的底层模型候选,但需自行验证实际任务中的准确率、上下文长度和工具调用稳定性。目前公开信息未提及具体定价或 IDE 集成时间表,建议以 JetBrains 官方后续公告为准。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一,Mellum2.1 是否会在 IntelliJ IDEA 等 JetBrains 产品中默认启用或提供可选下载,以及面向个人开发者的许可条款是否变化。第二,第三方独立评测能否复现“高负载吞吐量接近 Qwen3.5-9B 两倍”的结论,尤其是在真实代码仓库和长上下文任务中的表现。第三,Qwen、DeepSeek 等开源编程模型是否会跟进强化学习与多 Token 预测路线,推动开源模型在智能体编程方向上的整体迭代。

来源:AIbase

celebrityanime
celebrityanime
文章: 28629

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注