模型 / Nemotron-Labs-Audex-2B (NVIDIA)

Nemotron-Labs-Audex-2B (NVIDIA)

统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成

作者
nvidia
适合
语音识别与翻译、音频问答 / 文本转语音、音频生成
不适合
商业用途 (非商用许可)
入选理由
统一音频文本的多任务模型,支持理解、识别、翻译、TTS和音频生成,128K上下文,需自建vLLM环境且仅限非商业使用。
规模
2B · 128k · 最低 ~1.2GB · 4-bit(估算)
授权
NVIDIA OneWay Noncommercial License · 需自查
框架
vllm / transformers
国内访问
需代理
可信度
NVIDIA 发布,技术报告 arXiv:2607.05196,兼容 vLLM 与 transformers

社区实测

Nemotron 系列在开源社区关注度远低于 Qwen 和 Gemma,整体口碑存在分歧:部分用户认为小尺寸模型在其规格下表现不错,但较多体验反馈认为不如其基于的 Qwen 模型。

  • 小尺寸 Nemotron 模型在批量 token 处理任务中表现不差,有用户认为同尺寸下目前最佳
  • 社区讨论热度和实际使用量远低于 Qwen 和 Gemma 系列
  • 有用户反映 Nemotron 模型在实际使用中始终不如其基于的 Qwen 模型

截至 2026-07-19

本形态 ~1.2GB 4-bit · 国内 需代理 · 1,050 下载

快速上手

python -c "from transformers import AutoModel; AutoModel.from_pretrained('nvidia/Nemotron-Labs-Audex-2B', trust_remote_code=True)"

本形态源 ↗

下载动量

30天下载 1.5k → 2.3k

观测时间线