LFM2.5-8B-A1B (LiquidAI)
混合架构边缘语言模型,GGUF 量化,供 llama.cpp 部署
社区实测
在消费级硬件上跑得动的轻量本地 agent 模型,工具调用可用但编码能力明显偏弱
- 在入门级笔记本/消费级 GPU 上本地运行 agent 工作流(Q4_K_M GGUF + Ollama,RTX 4060 约 76 tok/s)
- 原生工具调用(tool calling),支持 llama.cpp / Ollama / MLX / vLLM / SGLang 等运行时
- 通过扩展词表改善非拉丁语言(日语、法语、阿拉伯语等)的分词效率
- 编码能力是明显短板(实测 4/5 道编码题未通过)
- 部分用户在自有测试框架中遇到模型不可用的情况
- 工具调用功能曾存在问题,后续通过更新 GGUF 修复
来源
Liquid AI releases LFM2.5-8B-A1B : r/LocalLLaMALiquidAI/LFM2.5-8B-A1B · Hugging Face : r/LocalLLaMA - RedditLFM2.5-8B-A1B — Fastest Local AI Agent on a Laptop? (6 Tests)
截至 2026-06-19
快速上手
ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-GGUF