Nemotron-Labs-Audex-30B-A3B (NVIDIA)
音频-文本统一LLM,兼顾文本推理与语音/音频生成
仓库标识nvidia/Nemotron-Labs-Audex-30B-A3B
显存未知许可 需自查任务 文本生成最近核对 2026-08-02
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- vllm
适合与不适合
独立证据与社区反馈
社区关注度低,实测反馈两极分化:部分用户能在消费级硬件上流畅运行,推理速度可观,但代码任务质量不佳、幻觉明显。
- 可在 16GB 显存的消费级 GPU(如 AMD 9060 XT)上直接运行,无需额外调优
- 推理速度在 M4 Pro 上达到约 90 token/s,足以满足日常使用
- 幻觉率 9.6%,在其参数规模下接近更大的 Qwen3-Next-80B-A3B-Thinking(9.3%)
- 代码分析任务幻觉严重,给定代码库后立即开始编造信息,无法替代真正的编码 agent
- 30B 参数却命名为 'Nano',社区普遍认为名称具有误导性
- 社区讨论度和实际采用率远低于 Qwen / Gemma 等同期竞品
- 无法装入 RTX 5090,对高端消费级显卡的部署仍有门槛
- 社区实测Nvidia Nemotron 3 Family of Models | Hacker News
- 社区实测NVIDIA Nemotron — does anyone actually use it?
可信度NVIDIA发布,技术报告arXiv:2607.05196,提供vLLM/HF推理脚本及复现步骤
完整规格
下载动量
30天下载 621 → 515 · likes +2