Nemotron-3-Embed-1B (NVIDIA) 多语言文本嵌入模型,用于语义搜索与 RAG 入选理由NVIDIA最新1B嵌入模型,支持34种语言和32K上下文,通过vLLM可快速部署为OpenAI兼容API,适合多语言RAG检索。 对位对位 BGE-M3 / multilingual-e5-large 适合多语言语义搜索 / RAG 系统的检索组件 不适合不适用于文本生成 规模1.14B · 32768 · Q4 ~0.8GB / FP16 ~2.7GB 授权OpenMDW-1.1 · 需自查 框架transformers / sentence-transformers / vllm 维度2048 维 · 256k 序列 血统微调自 Ministral-3-3B-Instruct-2512 可信度46k 下载 · 60 点赞 · RTEB NDCG@10 72.38 仅 safetensors · 无 pickle 加载风险 快速上手 vllm serve nvidia/Nemotron-3-Embed-1B-BF16 点击复制