Nemotron-3-Nano-30B-A3B (NVIDIA)
4bit MoE本地运行于Apple Silicon
社区实测
30B级别中综合能力突出,推理速度快、长上下文处理高效,编程和通用问答表现优异,但风格偏机械不适合创意写作
- 在预算有限/异构硬件上流畅运行30B级模型,降低本地AI使用门槛
- 本地编程辅助:单次提示即可生成正确可用代码,提升开发效率
- 长上下文处理:256K上下文可完全装入有限VRAM,支持1M扩展
- 风格偏机械/生硬,不适合创意写作和对话场景
- 官方宣称的4倍速提升存在夸大,实际提速明显但未达宣称水平
- 合成数据训练可能影响回答质量
- 部分基准测试不及GLM 4.7 Flash
来源
Nemotron 3 Nano 30B is Amazing! (TLDR) : r/LocalLLaMANvidia Nemotron 3-Nano 30B-A3B-BF16 | Hacker NewsNemotron-3-nano:30b is a spectacular general purpose ...Nvidia released Nemotron 3 nano recently and I think it fits ...
截至 2026-07-19
本形态显存 Q4 ~20GB / FP16 ~72GB · 国内 需代理 · 855 下载
仅 safetensors · 无 pickle 加载风险
快速上手
mlx_lm.generate --model mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit