LFM2.5-Embedding-350M (LiquidAI)
11语种双编码器,面向端侧语义检索
社区实测
社区对 LFM2.5-Embedding-350M 以 350M 小参数量实现超低延迟多语言检索表示兴奋
- 端到端检索延迟低至 1.5ms(企业栈),CPU 上通过 llama.cpp 也可做到 <10ms
- 覆盖 11 种语言的多语言与跨语言检索
- 350M 小体积可运行在笔记本、边缘设备上
来源
Liquid AI releases LFM2.5-Embedding-350M and LFM2.5-ColBERT ...LFM2.5 Retrievers: Bi-directional LFMs for Fast Multilingual SearchLiquid AI on X: "Introducing LFM2.5-Embedding-350M and LFM2.5-ColBERT-350M..."
截至 2026-06-19
本形态 ~0.2GB 4-bit · 国内 需代理 · 3,734 下载
仅 safetensors · 无 pickle 加载风险
快速上手
llama-server -hf LiquidAI/LFM2.5-Embedding-350M-GGUF (需安装llama.cpp) 下载动量
30天下载 36.7k → 32.6k · likes +41
观测时间线
模型家族
- LFM2.5-350M-Base
- 微调 LFM2.5-ColBERT-350M (LiquidAI)
- 微调 LFM2.5-Embedding-350M (LiquidAI)