模型 / Nemotron-3-Embed-1B (NVIDIA)

Nemotron-3-Embed-1B (NVIDIA)

多语言文本嵌入模型,用于语义搜索与 RAG

作者
nvidia
对位
对位 BGE-M3 / multilingual-e5-large
适合
多语言语义搜索 / RAG 系统的检索组件
不适合
不适用于文本生成
入选理由
NVIDIA最新1B嵌入模型,支持34种语言和32K上下文,通过vLLM可快速部署为OpenAI兼容API,适合多语言RAG检索。
规模
1.14B · 32768 · Q4 ~0.8GB / FP16 ~2.7GB
授权
OpenMDW-1.1 · 需自查
框架
transformers / sentence-transformers / vllm
维度
2048 维 · 256k 序列
血统
微调自 Ministral-3-3B-Instruct-2512
国内访问
需代理
可信度
46k 下载 · 60 点赞 · RTEB NDCG@10 72.38

本形态显存 Q4 ~0.8GB / FP16 ~2.7GB · 国内 需代理 · 46,305 下载

仅 safetensors · 无 pickle 加载风险

快速上手

vllm serve nvidia/Nemotron-3-Embed-1B-BF16

本形态源 ↗

下载动量

观测时间线

模型家族

查看全部家族 →