LFM2.5-8B-A1B (Liquid AI)
8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型
社区实测
社区实测反馈两极:在 Ollama + RTX 4060 上工具调用与推理可用,约 76 tok/s;但全量模型在部分自建测试框架中无法正常使用。
- 本地工具调用/Agent 工作流(Ollama 原生 tool calling 可用)
- 消费级硬件上的低延迟推理(RTX 4060 笔记本约 76 tok/s)
- JSON 结构化输出
- 多语言(日/法/阿拉伯语)基本可用
- 编码能力较弱(6 项测试中 4/5 编码题失败)
- 全量模型(非 GGUF)在部分自建测试框架中无法正常使用
来源
Liquid AI releases LFM2.5-8B-A1B : r/LocalLLaMALFM2.5-8B-A1B — Fastest Local AI Agent on a Laptop? (6 Tests)
截至 2026-06-19
快速上手
ollama run hf.co/unsloth/LFM2.5-8B-A1B-GGUF