SummFlow 2026-06-19 Hugging Face

LFM2.5-ColBERT-350M (LiquidAI)

11 语言 ColBERT 检索模型,专为短文本 RAG 设计

入选理由
支持11种语言的高效多语检索模型,提供GGUF/HF Space/Colab,适合短文本检索和重排序,性能显著优于前代。
对位
对位 Alibaba-NLP/gte-multilingual-base
适合
多语言 RAG 流水线 / 消费级设备端语义搜索
不适合
长文档检索 (>512 tokens)
规模
350M · 32k · Q4 ~0.2GB / FP16 ~0.8GB
授权
LFM Open License v1.0 · 需自查
框架
transformers / pylate / llama.cpp
维度
1024 维 · 125k 序列
血统
微调自 LFM2.5-350M-Base
可信度
NanoBEIR 11 语言平均 NDCG@10 达 0.605,MKQA 召回率 0.694,均超 gte-multilingual-base

仅 safetensors · 无 pickle 加载风险

快速上手

llama-server -hf LiquidAI/LFM2.5-ColBERT-350M-GGUF --embeddings -ngl 99 (需先下载 GGUF 文件)