Nemotron-Labs-TwoTower-30B-A3B (NVIDIA)
双塔扩散LLM,块并行解码,2.42x生成吞吐量
社区实测
社区实测样本极少,个别用户反馈在低配硬件上可流畅运行,但整体口碑尚未形成
- 低配硬件可运行(6GB VRAM 旧游戏本)且保持实用推理速度
- 针对 NVIDIA 硬件优化,支持 TensorRT 以最大化性能
- 社区实测反馈极少,除个别用户外缺乏广泛真实使用验证
来源
What is everyones thoughts on Nemotron-Cascade 30b a3b - RedditNVIDIA Nemotron — does anyone actually use it? - Reddit
截至 2026-07-12
本形态 ~18GB 4-bit · 国内 需代理 · 7,628 下载
仅 safetensors · 无 pickle 加载风险
快速上手
python3 -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-TwoTower-30B-A3B-Base-BF16',trust_remote_code=True,torch_dtype='bfloat16').cuda()" (单GPU AR模式,约59GB显存) 下载动量
30天下载 11.5k → 11.7k