Nemotron-3-Embed-8B (NVIDIA)
多语言文本嵌入模型,面向RAG检索与语义搜索。
本形态显存 Q4 ~5.3GB / FP16 ~19GB · 国内 需代理 · 14,038 下载
仅 safetensors · 无 pickle 加载风险
快速上手
vllm serve nvidia/Nemotron-3-Embed-8B-BF16 模型 / Nemotron-3-Embed-8B (NVIDIA)
多语言文本嵌入模型,面向RAG检索与语义搜索。
本形态显存 Q4 ~5.3GB / FP16 ~19GB · 国内 需代理 · 14,038 下载
仅 safetensors · 无 pickle 加载风险
快速上手
vllm serve nvidia/Nemotron-3-Embed-8B-BF16 输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索