VibeThinker-3B (WeiboAI)
面向数学/代码/STEM的可验证推理3B小模型
仓库标识WeiboAI/VibeThinker-3B
显存未知许可 可商用任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- VLLM
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve WeiboAI/VibeThinker-3B 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
在数学/竞赛编程等可验证推理任务上跑分亮眼,但实际落地场景窄、不支持工具调用,社区普遍认为存在 benchmark 过拟合,日常编码体验不如同量级 Qwen3.5-4B。
- 仅 3B 参数就在 AIME26、HMMT25、LiveCodeBench、LeetCode 等可验证推理基准上达到或接近大模型水平
- MIT 开源、完全开放权重,可无限制商用
- 不支持工具调用(tool use),官方定位仅限竞赛编程/可验证编码任务
- 实际编码任务(如根据论文 PDF 实现线性代数)表现远不如 Qwen3.5-4B
- 社区怀疑存在严重的 benchmark 过拟合(benchmaxing),跑分与实际体验落差大
- 量化推理行为文档不足,量化后表现不稳定
- 独立评测VibeThinker-3B: The Complete Guide (2026)
- 独立评测VibeThinker: 3B model reasons and codes at the level of flagship models
- 基准/排行VibeThinker-3B: Exploring the Frontier of Verifiable ...
- 官方/厂商GitHub - WeiboAI/VibeThinker
- 官方/厂商WeiboAI/VibeThinker-3B · I tested this model
可信度IMO-AnswerBench 76.4,LeetCode周赛通过率96.1%
完整规格
下载动量
30天下载 14.7k → 11.2k · likes +12
观测时间线
模型家族
- Qwen2.5-Coder-3B
- 微调 VibeThinker-3B (WeiboAI)