此页是 2026-08-14 的观测快照,查看该模型当前信息 → /m/nvidia__nvidia-nemotron-35-lightning-30b-a3b-bf16/

归档 / 2026-08-14 / NVIDIA-Nemotron-3.5-Lightning-30B-A3B (NVIDIA)

NVIDIA-Nemotron-3.5-Lightning-30B-A3B (NVIDIA)

30B 总参 / 3B 激活 MoE,本地 GGUF 部署

入选理由
NVIDIA Nemotron 3.5 Lightning 30B A3B 的 GGUF 量化版,可直接在 LM Studio/llama.cpp 本地运行,适合需要高效本地推理的用户。
对位
对位 Qwen3-30B-A3B
适合
LM Studio 本地对话 / 低激活成本批量生成
不适合
复杂多步推理或长上下文任务
规模
30B (A3B 激活) · 未知 · Q4 ~20GB / FP16 ~72GB
授权
未知 · 需自查
框架
llama.cpp
可信度
HF 下载量 5178;GGUF 由 LM Studio 团队基于 llama.cpp 转换

快速上手示例

llama-server -hf lmstudio-community/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-14)

作者
lmstudio-community
任务类型
unknown
推理库
未指定
下载
5,178
点赞
3
许可证
未知
标签
gguf, endpoints_compatible, region:us, conversational

探索

源链接