SummFlow 2026-05-26 Hugging Face

MiniCPM5-1B (OpenBMB)

1B 端侧模型,工具调用与混合推理

入选理由
可直接试用HF Space或GGUF/Ollama,1B参数长上下文+推理能力。
对位
对位 Qwen3-0.6B / LFM2.5-1.2B
适合
端侧部署与桌面助手 / 工具调用与代码生成
不适合
安全关键任务需人工校验
规模
1.08B · 131k · Q4 ~0.7GB / FP16 ~2.6GB
授权
Apache-2.0 · 可商用
框架
vllm / sglang / transformers / ollama / llama.cpp
可信度
RL+OPD 提升 16 分; 标准 Llama 架构, 无需自定义内核

仅 safetensors · 无 pickle 加载风险

社区实测

MiniCPM5-1B 在 1B 量级开源模型中达到 SOTA,尤其擅长工具调用、代码生成与困难推理,但输出 token 量比前代模型更高。

  • 端侧/本地部署场景下提供 1B 量级最强开源性能
  • 在 agent 工具调用、代码生成、竞赛数学等任务上相比同尺寸模型优势明显
  • 相比更大尺寸的推理模型具有更高的 token 效率
  • 提供主流推理与微调框架的一页式 cookbook 和 Agent Skill
  • 输出 token 量约为前代 MiniCPM-V 4.6 1.3B 的 2.3 倍
  • 对比范围限于特定同尺寸模型集合,未覆盖所有 1B 模型

截至 2026-06-19

快速上手

vllm serve openbmb/MiniCPM5-1B