模型 / Mellum2-12B-A2.5B-Thinking (JetBrains)

Mellum2-12B-A2.5B-Thinking (JetBrains)

思考型助手,在<think>块中输出推理链后给出最终答案

作者 JetBrains

仓库标识JetBrains/Mellum2-12B-A2.5B-Thinking

显存未知许可 可商用任务 文本生成最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
799

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve JetBrains/Mellum2-12B-A2.5B-Thinking --max-model-len 131072 --reasoning-parser qwen3

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
来源于JetBrains的MoE思考模型,推理能力较强,支持vLLM快速部署。
对位
对位Qwen3.5与OLMo-3等开源推理模型
适合
复杂代码调试与多步规划 / 数学竞赛与逻辑推理题
不适合
低延迟闲聊或直接指令回答

独立证据与社区反馈

5 个独立来源最近验证 2026-08-05

低资源部署场景的编码能力超出预期,思考版显著优于指令版,是单 GPU 可跑的 MoE 模型里综合表现很扎实的选择。

  • 单 GPU 即可运行,12B 总参数仅 2.5B 激活,低显存环境下也能部署
  • Thinking 版基准分数显著优于 Instruct 版
  • 支持 FIM(填充中间代码),适合代码补全场景
  • Agent 工作流中提示预填充(Prompt Ingest)速度较快,适合密集读取代码库的代理任务
  • 部分社区用户希望有 15-20B 的更大尺寸版本,当前 12B 规模在某些场景下仍有局限
  • 同一模型无法同时擅长编码和知识库处理,需按具体场景分别选型

可信度在LiveCodeBench v6代码评测中pass@1达69.9%,在AIME 2025+2026数学评测均分58.4%

完整规格

规模
12B · 131k · 权重格式未知,无法估算显存
授权
Apache 2.0 · 可商用
框架
vllm / transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2.3k → 2.3k · likes +5

观测时间线