JetBrains 发布 Mellum2.1 编程模型:强化智能体代码修改与验证

10月8日,JetBrains 发布博文宣布上线 Mellum2.1 模型,继续采用12B混合专家架构和2.5B活跃参数,并以 Apache 2.0 许可证开放。与上一代相比,此次更新的主要变化集中在预训练后的强化学习阶段,团队将该环节从短期收尾扩展为训练主体,并补充了数学、算法竞赛、科学、工具使用和软件工程等任务的数据。

JetBrains 发布 Mellum2.1 编程模型:强化智能体代码修改与验证

在训练准备方面,JetBrains 搭建了内部强化学习环境基础设施,训练期间启动数百万个沙盒,覆盖数千个环境。团队还提前筛选开放数据集,剔除测试缺陷、不可验证答案以及难度不合适的任务。升级后的模型可以探索代码库、编辑文件并检查自身修改,官方称最大改进出现在智能体编程领域,能够识别失败测试的根因、起草修复方案并验证结果。

性能方面,Mellum2.1 与 Mellum2 架构一致,基础速度不变,多 Token 预测(MTP)使单请求场景下的响应速度提高约1.6倍。在相同评估设置下与 Mellum2、Qwen3.5-9B 和 Gemma 4 E4B 对比时,Mellum2.1 在高负载下的推理吞吐 Token 数量接近 Qwen3.5-9B 的两倍,并在编程、算法竞赛、数学、工具调用和通用知识等维度有提升。

目前该模型已上架 Hugging Face,可部署在本地或自有基础设施中,便于企业将代码和数据保留在自身环境。官方后续还计划提供面向 llama.cpp、Ollama 和 LM Studio 的 GGUF 版本,以及 vLLM 的 MTP 推测解码组件。