指南 / 向量嵌入模型 / 8GB 显存能跑

8GB 显存能跑的向量嵌入模型

共 7 个

显存档为包含式:更低显存也能跑的模型一并列在此。数值取 Q4 量化后显存估算。

Nemotron-3-Embed-1B-NVFP4 (NVIDIA) 多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计 Nemotron-3-Embed-8B (NVIDIA) 多语言文本嵌入模型,面向RAG检索与语义搜索。 Nemotron-3-Embed-1B (NVIDIA) 多语言文本嵌入模型,用于语义搜索与 RAG LFM2.5-ColBERT-350M (LiquidAI) 11 语言 ColBERT 检索模型,专为短文本 RAG 设计 LFM2.5-Embedding-350M (LiquidAI) 11语种双编码器,面向端侧语义检索 Lean Finder (delta-lab-ai) 面向数学证明的语义搜索嵌入模型,用于查找 mathlib 定理 jina-embeddings-v5-omni-small (Jina) 多模态嵌入模型,支持文本/图像/视频/音频