SummFlow 2026-06-03 Hugging Face

LFM2.5-8B-A1B (Liquid AI)

8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型

入选理由
LFM2.5 基础模型性能强且支持工具调用,但本模型仅为量化版本,无新能力。
对位
对位 Granite-4.0-H-Tiny (7B/A1B) 与 Qwen3.5-4B
适合
端侧个人助理及工具调用 / 多语言指令跟随与结构化输出
不适合
重度编程及无检索知识问答
规模
8.3B (1.5B active) · 128k
授权
LFM1.0 · 需自查
框架
llama.cpp / LM Studio / ollama
血统
量化自 LFM2.5-8B-A1B
可信度
下载量29k,Unsloth Dynamic 2.0量化,原模型IFEval 91.84,AA-Omniscience指数-24.70

社区实测

社区实测反馈两极:在 Ollama + RTX 4060 上工具调用与推理可用,约 76 tok/s;但全量模型在部分自建测试框架中无法正常使用。

  • 本地工具调用/Agent 工作流(Ollama 原生 tool calling 可用)
  • 消费级硬件上的低延迟推理(RTX 4060 笔记本约 76 tok/s)
  • JSON 结构化输出
  • 多语言(日/法/阿拉伯语)基本可用
  • 编码能力较弱(6 项测试中 4/5 编码题失败)
  • 全量模型(非 GGUF)在部分自建测试框架中无法正常使用

截至 2026-06-19

快速上手

ollama run hf.co/unsloth/LFM2.5-8B-A1B-GGUF