模型 / LFM2.5-Embedding-350M (LiquidAI)

LFM2.5-Embedding-350M (LiquidAI)

11语种双编码器,面向端侧语义检索

作者 LiquidAI

仓库标识LiquidAI/LFM2.5-Embedding-350M

显存未知许可 需自查任务 向量嵌入最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
sentence-transformers
下载
3,734

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
多语言检索新SOTA,支持11种语言,可用sentence-transformers或GGUF快速部署,适合RAG和语义搜索。
对位
对位 Qwen3-Embedding-0.6B
适合
端侧本地语义搜索 (文件/邮件) / 跨语言 FAQ/知识库检索
不适合
长文档 (>512 tokens) 检索

独立证据与社区反馈

2 个独立来源 · 另 1 官方/转载最近验证 2026-08-05

350M参数下在多语言检索基准上表现领先,GGUF格式可在CPU/笔记本/边缘设备运行,但社区实测反馈仍较少

  • 以350M参数在NanoBEIR和MKQA-11上超越更大规模的Qwen3-Embedding-0.6B,适合资源受限场景
  • 通过GGUF格式在llama.cpp上部署,缓存查询延迟低于10ms,可在CPU/笔记本/边缘设备运行
  • 覆盖11种语言的多语言与跨语言检索
  • 使用时需注意非对称的query:和document:前缀,集成时不可忽略
  • Ollama端更新llama.cpp依赖偏慢,Ollama用户可能无法及时获得最新支持

可信度下载3734,多语言NanoBEIR NDCG@10 0.577,MKQA Recall@20 0.691,同级最佳,已出GGUF

完整规格

规模
350M · 32k · 权重格式未知,无法估算显存
授权
lfm1.0 · 需自查
框架
sentence-transformers / llama.cpp
维度
1024 维 · 125k 序列
血统
微调自 LFM2.5-350M-Base
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 9.6k → 21.7k · likes +7

观测时间线

模型家族

查看全部家族 →