此页是 2026-08-12 的观测快照,查看该模型当前信息 → /m/nvidia__nvidia-nemotron-35-lightning-30b-a3b-nvfp4/

归档 / 2026-08-12 / Nemotron-3.5-Lightning-30B-A3B (NVIDIA)

Nemotron-3.5-Lightning-30B-A3B (NVIDIA)

3B活跃参数,面向本地Agent和长上下文推理

  • 已量化
入选理由
MoE+Mamba-2混合架构,30B总参仅3B激活,支持1M上下文,官方NVFP4量化可单卡H100跑,适合长程agent部署。
对位
对位 Qwen3-30B-A3B 等 3B 激活 MoE
适合
长时间运行的自主Agent / 本地高效推理部署
不适合
不宜高难度科学推理
规模
30B (3B active) · 1M · Q4 ~12GB / FP16 ~43GB
授权
OpenMDW-1.1 · 需自查
框架
vllm / tensorrt-llm / sglang
工具调用
OpenAI-style function calling
可信度
19250下载,109赞,支持vLLM/TRT-LLM/SGLang

仅 safetensors · 无 pickle 加载风险

快速上手示例

vllm serve nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   5 / 5
总分
13

HuggingFace 原始数据 (抓取于 2026-08-12)

作者
nvidia
任务类型
text-generation
推理库
transformers
下载
19,250
点赞
109
许可证
OpenMDW-1.1
标签
transformers, safetensors, nemotron_h, text-generation, nvidia, pytorch, nemotron-3.5, conversational, en, es, fr, de, it, ja, license:other, endpoints_compatible, 8-bit, modelopt, deploy:azure, region:us

探索

源链接