
Nemotron-3-Embed-1B (NVIDIA)
- 对位
- 对位 BGE-M3 / multilingual-e5-large
- 适合
- 多语言语义搜索 / RAG 系统的检索组件
- 不适合
- 不适用于文本生成
- 入选理由
- NVIDIA最新1B嵌入模型,支持34种语言和32K上下文,通过vLLM可快速部署为OpenAI兼容API,适合多语言RAG检索。
- 规模
- 1.14B · 32768 · Q4 ~0.8GB / FP16 ~2.7GB
- 授权
- OpenMDW-1.1 · 需自查
- 框架
- transformers / sentence-transformers / vllm
- 维度
- 2048 维 · 256k 序列
- 血统
- 微调自 Ministral-3-3B-Instruct-2512
- 国内访问
- 需代理
- 可信度
- 46k 下载 · 60 点赞 · RTEB NDCG@10 72.38
本形态显存 Q4 ~0.8GB / FP16 ~2.7GB · 国内 需代理 · 46,305 下载
仅 safetensors · 无 pickle 加载风险
快速上手
vllm serve nvidia/Nemotron-3-Embed-1B-BF16 点击复制
本形态源 ↗
模型家族
- Ministral-3-3B-Instruct-2512
- 微调 Nemotron-3-Embed-1B (NVIDIA)
查看全部家族 →