模型 / VibeThinker-3B (WeiboAI)

VibeThinker-3B (WeiboAI)

面向数学/代码/STEM的可验证推理3B小模型

作者 WeiboAI

仓库标识WeiboAI/VibeThinker-3B

显存未知许可 可商用任务 文本生成最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
VLLM

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve WeiboAI/VibeThinker-3B

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
该模型在数学/代码推理任务上表现突出,需自行写transformers代码运行,适合研究小模型推理极限的开发者。
对位
对位 Qwen2.5-Coder-3B
适合
数学/编程竞赛解题 / STEM可验证推理任务
不适合
工具调用/Agent编程

独立证据与社区反馈

3 个独立来源 · 另 2 官方/转载最近验证 2026-08-05

在数学/竞赛编程等可验证推理任务上跑分亮眼,但实际落地场景窄、不支持工具调用,社区普遍认为存在 benchmark 过拟合,日常编码体验不如同量级 Qwen3.5-4B。

  • 仅 3B 参数就在 AIME26、HMMT25、LiveCodeBench、LeetCode 等可验证推理基准上达到或接近大模型水平
  • MIT 开源、完全开放权重,可无限制商用
  • 不支持工具调用(tool use),官方定位仅限竞赛编程/可验证编码任务
  • 实际编码任务(如根据论文 PDF 实现线性代数)表现远不如 Qwen3.5-4B
  • 社区怀疑存在严重的 benchmark 过拟合(benchmaxing),跑分与实际体验落差大
  • 量化推理行为文档不足,量化后表现不稳定

可信度IMO-AnswerBench 76.4,LeetCode周赛通过率96.1%

完整规格

规模
3B · 64k · 权重格式未知,无法估算显存
授权
MIT · 可商用
框架
transformers / vllm / sglang
血统
微调自 Qwen2.5-Coder-3B
访问提示
标记为魔搭可用,具体仓库请自行核对

下载动量

30天下载 14.7k → 11.2k · likes +12

观测时间线

模型家族

查看全部家族 →