Mellum2-12B-A2.5B-Thinking (JetBrains)
思考型助手,在<think>块中输出推理链后给出最终答案
仅 safetensors · 无 pickle 加载风险
社区实测
12B MoE(2.5B 激活)推理速度快,编码接近 Qwen 3.5 9B,定位为系统内嵌快速组件而非前沿替代品
- MoE 架构推理速度明显优于同规模稠密模型
- 编码能力接近 Qwen 3.5 9B 水平
- 商业、邮件、代码类任务综合评分扎实(8.62/10)
- 设计定位为系统内快速组件,非前沿模型替代品
- 复杂调试类任务对当前参数量仍有难度
来源
Mellum 2 12B A2.5B : r/LocalLLaMAa really good and performant model : r/LocalLLaMAr/LocalLLaMA - JetBrains open-sources Mellum2 - anyone tried these?JetBrains Releases Mellum2: A 12B MoE Model for Fast ... - Reddit
截至 2026-06-19
快速上手
vllm serve JetBrains/Mellum2-12B-A2.5B-Thinking --max-model-len 131072 --reasoning-parser qwen3