模型 / LFM2.5-8B-A1B-DSpark-GGUF (LiquidAI)

LFM2.5-8B-A1B-DSpark-GGUF (LiquidAI)

8B-A1B 投机解码草稿侧车,配 llama.cpp 加速

作者 LiquidAI

仓库标识LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF

~4.8GB 4-bit许可 需自查任务 文本生成最近核对 2026-08-21
格式
4-bit
文件
~4.2GB
运行内存
~4.8GB–6.2GB
运行时
OLLAMA

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
这是 LFM2.5-DSpark 的草稿模型,需与目标 GGUF 配对,在 llama.cpp 中实现投机解码加速,官方提供直接运行命令,适合本地部署用户。
适合
llama.cpp 本地加速推理 / 目标模型 DSpark 投机解码
不适合
单独作为主模型部署

完整规格

规模
8B · 下载 ~4.2GB · 显存最低 ~4.8GB · 推荐 ~6.2GB · 4-bit(估算)
授权
other (lfm1.0) · 需自查
框架
llama.cpp
血统
量化自 LFM2.5-8B-A1B-DSpark-Draft-v1
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 4.1k → 18.8k

观测时间线