模型 / Mellum2-12B-A2.5B-Instruct (JetBrains)

Mellum2-12B-A2.5B-Instruct (JetBrains)

直接回答的指令模型,用于交互聊天、代码和工具调用

作者
JetBrains
对位
对位 Ministral 3 14B、Qwen3.5-9B 等指令模型
适合
交互式聊天与代码辅助 / 工具调用与指令跟随
不适合
需显式推理的多步代理流
入选理由
JetBrains的MoE模型,Apache-2.0许可,上下文131k,需自行部署。
规模
12B (2.5B active) · 131k · 最低 ~7.3GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
vllm / transformers
国内访问
需代理
可信度
1418下载,48赞;LiveCodeBench v6 37.2%,EvalPlus 78.4%,BFCL v4 44.2%

社区实测

JetBrains 发布的编码导向小参数量 MoE,代码/业务/邮件任务表现扎实,但通用能力有限。

  • 编码任务表现接近 Qwen 3.5 9B
  • 业务、邮件、代码类任务表现优异
  • Instruct 版本直接回答、不输出推理链,延迟低
  • 非编码类通用能力弱于 Qwen 3.5 4B
  • 部分任务仅获中等结果

截至 2026-07-19

本形态 ~7.3GB 4-bit · 国内 需代理 · 1,418 下载

仅 safetensors · 无 pickle 加载风险

快速上手

vllm serve JetBrains/Mellum2-12B-A2.5B-Instruct --max-model-len 131072

本形态源 ↗

下载动量

30天下载 5.9k → 5k · likes +8

观测时间线