JetBrains 新 AI 模型 Mellum2.1 在高负载下吞吐量翻倍
JetBrains 新 AI 模型 Mellum2.1 在高负载下吞吐量翻倍
JetBrains,这家你可能每天都在使用的工具背后的公司,正式发布了 Mellum2.1——一个编程 AI 模型,旨在让基于代理的编码更智能、更快速。而且,它仍然是开源的,这意味着企业和个人开发者可以私下部署,而无需花费巨资。
强化学习:秘密武器
那么有什么新功能?首先,Mellum2.1 将强化学习从短期实验转变为主要的训练引擎。该模型经历了严苛的训练——在数百万个沙盒环境中针对软件工程和算法进行专门训练。结果呢?它现在可以自我检索和自我验证, pinpointing 测试失败的原因并起草修复方案,无需人工干预。
真正重要的速度
这里变得有趣了。得益于多令牌预测,Mellum2.1 在单请求场景下的响应速度大约快 1.6 倍。但真正的亮点是在高负载下:官方测试显示,其令牌吞吐量几乎是Qwen3.5-9B 的两倍,后者是一个流行的开源模型。这不仅仅是规格表上的胜利——当您大规模部署代码时,它意味着显著的成本节约。
为什么你应该关心
如果你是开发者,这意味着更少的等待和更多的行动。如果你在管理一个团队,这意味着你的基础设施预算可以发挥更大作用。如果你只是对 AI 好奇,这是另一个迹象,表明开源模型正在赶上——有时甚至超越——大型闭源玩家。
关键点
- 开源且可私有部署:没有供应商锁定,没有巨额账单。
- 大规模强化学习:在数百万个沙盒中训练,用于现实世界的编码任务。
- 响应速度快 1.6 倍:多令牌预测加速单个请求。
- 负载下吞吐量翻倍:在高需求场景下优于 Qwen3.5-9B。
- 自我验证:可以自主识别失败的测试并提出修复建议。

JetBrains 不仅仅是在擂台上扔出另一个模型——他们正在解决代理编码的混乱现实。而有了 Mellum2.1,他们有力地证明了开源既可以强大又可以实用。