JetBrains 上线 Mellum2.1 模型,延续 12B 混合专家架构、2.5B 活跃参数,Apache 2.0 许可,重点增强智能体编程能力,强化学习阶段扩展为训练主体。高负载推理吞吐接近 Qwen3.5-9B 两倍,MTP 使单请求速度提升约 1.6 倍。模型已登陆 Hugging Face,后续将推出 GGUF 版本及 vLLM 组件。