LFM2.5-Embedding-350M (LiquidAI)
11语种双编码器,面向端侧语义检索
仅 safetensors · 无 pickle 加载风险
社区实测
社区对 LFM2.5-Embedding-350M 以 350M 小参数量实现超低延迟多语言检索表示兴奋
- 端到端检索延迟低至 1.5ms(企业栈),CPU 上通过 llama.cpp 也可做到 <10ms
- 覆盖 11 种语言的多语言与跨语言检索
- 350M 小体积可运行在笔记本、边缘设备上
来源
Liquid AI releases LFM2.5-Embedding-350M and LFM2.5-ColBERT ...LFM2.5 Retrievers: Bi-directional LFMs for Fast Multilingual SearchLiquid AI on X: "Introducing LFM2.5-Embedding-350M and LFM2.5-ColBERT-350M..."
截至 2026-06-19
快速上手
llama-server -hf LiquidAI/LFM2.5-Embedding-350M-GGUF (需安装llama.cpp)