SummFlow 2026-06-05 Hugging Face

Mellum2-12B-A2.5B-Instruct (JetBrains)

直接回答的指令模型,用于交互聊天、代码和工具调用

入选理由
JetBrains的MoE模型,Apache-2.0许可,上下文131k,需自行部署。
对位
对位 Ministral 3 14B、Qwen3.5-9B 等指令模型
适合
交互式聊天与代码辅助 / 工具调用与指令跟随
不适合
需显式推理的多步代理流
规模
12B (2.5B active) · 131k · Q4 ~8GB / FP16 ~29GB
授权
apache-2.0 · 可商用
框架
vllm / transformers
可信度
1418下载,48赞;LiveCodeBench v6 37.2%,EvalPlus 78.4%,BFCL v4 44.2%

仅 safetensors · 无 pickle 加载风险

社区实测

社区实测样本偏少,现有反馈认为其在代码与业务类任务上表现扎实,但对其通用场景与 IDE 外适配仍存疑虑

  • 以 2.5B 活跃参数的 MoE 架构提供低延迟的本地代码辅助与工具调用
  • 在业务、邮件、代码等任务上获得 8.62/10 的综合评分
  • 社区实测量不足,缺乏大规模独立验证
  • 有反馈称其在 JetBrains IDE 之外体验不佳

截至 2026-06-19

快速上手

vllm serve JetBrains/Mellum2-12B-A2.5B-Instruct --max-model-len 131072