Nemotron-3-Nano-Omni-30B-A3B (NVIDIA)
NVIDIA 多模态推理模型 GGUF 量化版,本地推理用
仓库标识lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
显存未知最近核对 2026-08-09
链接指向的配置 不在本页收录的形态里,已显示默认形态(GGUF)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- LLAMA-SERVER
- 下载
- 168,900
快速上手示例
llama-server -hf lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
推理速度快、长上下文召回优秀,但编程/Agent 任务不如 Qwen 3.5 35B A3B,且量化版本与工具调用存在问题
- 推理速度快(140+ tokens/s),适合本地部署
- 长上下文(800k)下多 needle 召回准确
- 提示处理速度快,适合作为子 Agent 使用
- 编程和 Agent 任务表现不如 Qwen 3.5 35B A3B
- 量化版本存在稳定性问题
- 不支持工具调用(Hermes Agent 下无法使用)
- 30B 系列模型即使处理非时事内容也倾向依赖在线资源
- 社区实测Nemotron 3 Nano 30B速度实测
- 社区实测Nemotron 30B工具调用与在线依赖讨论
- 社区实测Nemotron子Agent与800k上下文测试
- 社区实测Nemotron量化版本问题讨论
- 社区实测Nemotron vs Qwen编码对比
可信度HuggingFace 168900 下载,LM Studio 社区精选
完整规格
下载动量
30天下载 60.8k → 54.1k · likes +1