此页是 2026-07-11 的观测快照,查看该模型当前信息 → /m/nvidia__nemotron-labs-audex-2b/

归档 / 2026-07-11 / Nemotron-Labs-Audex-2B (NVIDIA)

Nemotron-Labs-Audex-2B (NVIDIA)

统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成

入选理由
统一音频文本的多任务模型,支持理解、识别、翻译、TTS和音频生成,128K上下文,需自建vLLM环境且仅限非商业使用。
对位
适合
语音识别与翻译、音频问答 / 文本转语音、音频生成
不适合
商业用途 (非商用许可)
规模
2B · 128k · Q4 ~1.3GB / FP16 ~4.8GB
授权
NVIDIA OneWay Noncommercial License · 需自查
框架
vllm / transformers
可信度
NVIDIA 发布,技术报告 arXiv:2607.05196,兼容 vLLM 与 transformers

快速上手

python -c "from transformers import AutoModel; AutoModel.from_pretrained('nvidia/Nemotron-Labs-Audex-2B', trust_remote_code=True)"

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-07-11)

作者
nvidia
任务类型
text-generation
推理库
transformers
下载
1,050
点赞
53
许可证
NVIDIA OneWay Noncommercial License
标签
transformers, safetensors, nemotron_labs_audex, nvidia, nemotron-labs-audex, reasoning, general-purpose, SFT, audio-language-modeling, audio-understanding, text-to-speech, text-to-audio, speech-recognition, speech-translation, text-generation, en, arxiv:2607.05196, license:other, endpoints_compatible, region:us

探索

源链接