此页是 2026-07-11 的观测快照,查看该模型当前信息 → /m/nvidia__nemotron-labs-audex-2b/
归档 / 2026-07-11 / Nemotron-Labs-Audex-2B (NVIDIA)
Nemotron-Labs-Audex-2B (NVIDIA)
统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成
- 入选理由
- 统一音频文本的多任务模型,支持理解、识别、翻译、TTS和音频生成,128K上下文,需自建vLLM环境且仅限非商业使用。
- 对位
- 适合
- 语音识别与翻译、音频问答 / 文本转语音、音频生成
- 不适合
- 商业用途 (非商用许可)
- 规模
- 2B · 128k · Q4 ~1.3GB / FP16 ~4.8GB
- 授权
- NVIDIA OneWay Noncommercial License · 需自查
- 框架
- vllm / transformers
- 可信度
- NVIDIA 发布,技术报告 arXiv:2607.05196,兼容 vLLM 与 transformers
快速上手
python -c "from transformers import AutoModel; AutoModel.from_pretrained('nvidia/Nemotron-Labs-Audex-2B', trust_remote_code=True)" 点击复制
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 5 / 5
- 总分
- 9
HuggingFace 原始数据 (抓取于 2026-07-11)
- 作者
- nvidia
- 推理库
- transformers
- 下载
- 1,050
- 点赞
- 53
- 许可证
- NVIDIA OneWay Noncommercial License
- 标签
- transformers, safetensors, nemotron_labs_audex, nvidia, nemotron-labs-audex, reasoning, general-purpose, SFT, audio-language-modeling, audio-understanding, text-to-speech, text-to-audio, speech-recognition, speech-translation, text-generation, en, arxiv:2607.05196, license:other, endpoints_compatible, region:us
探索
源链接