此页是 2026-07-19 的观测快照,查看该模型当前信息 → /m/nvidia__nemotron-3-embed-8b-bf16/

归档 / 2026-07-19 / Nemotron-3-Embed-8B (NVIDIA)

Nemotron-3-Embed-8B (NVIDIA)

多语言文本嵌入模型,面向RAG检索与语义搜索。

入选理由
8B多语言embedding模型,支持32768长度,可用vLLM一键启在线服务,适合中文RAG场景,但需较大显存。
对位
对位 e5-mistral-7b 等开源嵌入模型
适合
多语言RAG检索增强生成 / 代码语义搜索与匹配
不适合
不适用于文本生成或对话
规模
8B · 32768 · Q4 ~5.3GB / FP16 ~19GB
授权
OpenMDW-1.1 · 需自查
框架
transformers / sentence-transformers / vllm
维度
4096 维 · 256k 序列
可信度
RTEB 78.46 NDCG@10,34语种,HuggingFace 14k下载,vLLM/Sentence Transformers原生支持。

快速上手

vllm serve nvidia/Nemotron-3-Embed-8B-BF16

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-07-19)

作者
nvidia
任务类型
sentence-similarity
推理库
sentence-transformers
下载
14,038
点赞
52
许可证
OpenMDW-1.1
标签
sentence-transformers, safetensors, ministral3, feature-extraction, text, text-embeddings, retrieval, semantic-search, transformers, rag, vllm, sentence-similarity, multilingual, en, ar, as, bn, bg, zh, da, nl, fi, fr, de, hi, id, it, ja, ko, ms, mr, ne, no, fa, pt, ro, ru, es, sw, sv, ta, te, th, uk, ur, vi, arxiv:2502.13595, base_model:mistralai/Ministral-3-8B-Instruct-2512, base_model:finetune:mistralai/Ministral-3-8B-Instruct-2512, license:other, endpoints_compatible, deploy:azure, region:us

探索

源链接