此页是 2026-07-09 的观测快照,查看该模型当前信息 → /m/nvidia__nemotron-labs-audex-30b-a3b/

归档 / 2026-07-09 / Nemotron-Labs-Audex-30B-A3B (NVIDIA)

Nemotron-Labs-Audex-30B-A3B (NVIDIA)

音频-文本统一LLM,兼顾文本推理与语音/音频生成

入选理由
统一音频-文本MoE模型,支持理解、识别、翻译、生成及语音交互,需vLLM和多卡推理。适合有算力的开发者。
对位
对位 3B级稠密模型(如Qwen2.5-3B)
适合
音频理解、语音识别与翻译 / 文本-语音/音频生成与对话
不适合
商业部署(非商业许可)
规模
30B MoE (3B激活) · 1M · Q4 ~20GB / FP16 ~72GB
授权
NVIDIA Oneway Noncommercial License · 需自查
框架
vllm / transformers
可信度
NVIDIA发布,技术报告arXiv:2607.05196,提供vLLM/HF推理脚本及复现步骤

快速上手

python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-Audex-30B-A3B', trust_remote_code=True)"

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-07-09)

作者
nvidia
任务类型
text-generation
推理库
transformers
下载
0
点赞
67
许可证
NVIDIA Oneway Noncommercial License
标签
transformers, safetensors, nemotron_labs_audex, nvidia, nemotron-labs-audex, reasoning, general-purpose, SFT, RL, audio-language-modeling, audio-understanding, text-to-speech, text-to-audio, speech-recognition, speech-translation, text-generation, en, arxiv:2607.05196, license:other, endpoints_compatible, region:us

探索

源链接