Nemotron-3-Embed-8B (NVIDIA)
多语言文本嵌入模型,面向RAG检索与语义搜索。
仓库标识nvidia/Nemotron-3-Embed-8B-BF16
~17GB BF16许可 需自查任务 向量嵌入最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 格式
- BF16
- 文件
- ~15GB
- 运行内存
- ~17GB–22GB
- 运行时
- VLLM
- 下载
- 14,038
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve nvidia/Nemotron-3-Embed-8B-BF16 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
Nemotron-3-Embed-8B 发布即登顶 RTEB 检索基准排行榜,检索精度超过 OpenAI、Cohere、Voyage 等同类嵌入模型
- 前沿级检索精度,适合对检索质量要求高的 RAG 与智能体系统
- 多语言与跨语言检索,覆盖 34 种语言
- 提供 8B/1B 精度-效率梯度,1B 版本通过剪枝、蒸馏保留 8B 版本 95% 以上精度
- 混合架构(Transformer + Mamba-2)在非 NVIDIA 芯片(如 Cerebras/Groq)上编译部署较为困难
- 独立评测Frontier Retrieval Accuracy, Practical Deployment: NVIDIA Nemotron 3 ...
- 独立评测Build Anything with Nemotron 3 Embed 8B : Here's How
- 社区实测Nvidia Nemotron 3 Family of Models
- 官方/厂商nvidia/Nemotron-3-Embed-8B-BF16
可信度RTEB 78.46 NDCG@10,34语种,HuggingFace 14k下载,vLLM/Sentence Transformers原生支持。
完整规格
下载动量
30天下载 94.2k → 111.8k · likes +7