VibeThinker-3B (WeiboAI)
面向数学/代码/STEM的可验证推理3B小模型
仅 safetensors · 无 pickle 加载风险
社区实测
基准分数亮眼但实际编程体验分化明显,有用户认为存在过度拟合基准的问题
- 以 3B 参数量在可验证推理基准上达到大模型水平,适合竞赛数学与编程
- 支持通过 GGUF 在 LM Studio 等本地环境低资源部署
- 不支持工具调用
- 实际编程任务(如线性代数代码生成)表现远不如基准分数,有用户实测远逊于 Qwen 3.5 4B
- 存在过度拟合基准(benchmaxing)的嫌疑
来源
WeiboAI/VibeThinker-3B · Hugging FaceThis Small Open Source Model Just Matched Claude ai and GLM5GitHub - WeiboAI/VibeThinker: Tiny Model, Big Logic ...WeiboAI/VibeThinker-3B · I tested this model - Hugging Face[PDF] VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in ...
截至 2026-06-19
快速上手
vllm serve WeiboAI/VibeThinker-3B