JetBrains 发布 Mellum2.1 开放权重编码模型
JetBrains 发布开放权重编码模型 Mellum2.1,采用 12B MoE 架构,每次激活约 2.5B 参数,以 Apache 2.0 许可发布。模型经真实代码环境强化学习训练,用于仓库探索、文件修改和改动...
JetBrains 发布开放权重编码模型 Mellum2.1,采用 12B MoE 架构,每次推理激活约 2.5B 参数。模型以 Apache 2.0 许可发布,团队可以下载权重评估私有部署。
Mellum2.1 的训练方法包含真实代码环境中的强化学习,面向仓库探索、文件修改和改动检查等编码智能体任务。从架构看,MoE 设计降低了每次前向的激活参数,可能有利于推理效率,但实际收益仍取决于部署实现。
目前开放的只有权重,GGUF 与 vLLM 的多 token 预测支持尚未上线。这意味着团队在私有环境评估时,需要自行搭建推理栈,或等待后续提供更完整的部署支持,不能将这两项能力视为已经可用。
Apache 2.0 许可和开放权重降低了二次开发与商业集成的门槛,可以把该模型作为自部署编码代理的候选基础模型。不过,本次发布没有提供基准测试或与同类模型的对比数据,实际代码编辑能力需要在自有任务上验证。
输入也未披露上下文长度、支持的编程语言范围、部署所需硬件资源或量化版本。对生产部署而言,这些信息缺口意味着评估成本会更高,建议团队先在小规模代码库上验证稳定性与效果,再决定是否接入现有工作流。