此页是 2026-07-21 的观测快照,查看该模型当前信息 → /m/nvidia__nemotron-3-embed-1b-nvfp4/

归档 / 2026-07-21 / Nemotron-3-Embed-1B-NVFP4 (NVIDIA)

Nemotron-3-Embed-1B-NVFP4 (NVIDIA)

多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计

  • 已量化
入选理由
Nemotron-3嵌入模型的NVFP4量化版,通过vLLM一行命令部署,适合多语言RAG,需NVIDIA GPU(Ampere+)和vLLM环境。
对位
对位 BGE-M3、multilingual-e5 等同级开源嵌入模型
适合
多语言 RAG 检索 / 语义搜索与问答
不适合
生成式任务(仅输出嵌入向量)
规模
1.14B · 32k · Q4 ~0.5GB / FP16 ~1.8GB
授权
OpenMDW-1.1 · 需自查
框架
vllm
维度
2048 维 · 256k 序列
血统
量化自 Nemotron-3-Embed-1B-BF16
可信度
下载 6.6k,RTEB NDCG@10 得分 72.00,比 BF16 仅降 0.38

仅 safetensors · 无 pickle 加载风险

快速上手

vllm serve nvidia/Nemotron-3-Embed-1B-NVFP4

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-07-21)

作者
nvidia
任务类型
sentence-similarity
推理库
vllm
下载
6,682
点赞
55
许可证
OpenMDW-1.1
标签
vllm, safetensors, ministral3, text, text-embeddings, retrieval, semantic-search, nvfp4, rag, sentence-similarity, multilingual, en, ar, as, bn, bg, zh, da, nl, fi, fr, de, hi, id, it, ja, ko, ms, mr, ne, no, fa, pt, ro, ru, es, sw, sv, ta, te, th, uk, ur, vi, base_model:nvidia/Nemotron-3-Embed-1B-BF16, base_model:quantized:nvidia/Nemotron-3-Embed-1B-BF16, license:other, 8-bit, modelopt, deploy:azure, region:us

探索

源链接