此页是 2026-08-24 的观测快照,查看该模型当前信息 → /m/z-lab__qwen38-27b-dflash2/

归档 / 2026-08-24 / Qwen3.8-27B-DFlash2-GGUF (z-lab)

Qwen3.8-27B-DFlash2-GGUF (z-lab)

Qwen3.8-27B 的投机解码草案模型,需搭配目标模型使用

入选理由
DFlash2 是 Qwen3.8-27B 的投机解码草稿模型,需自建 llama.cpp 分支,可无损加速;适合已跑该模型的开发者。
对位
对位 Medusa/EAGLE 等投机草案模型
适合
降低 Qwen3.8-27B 生成延迟 / 提升批量推理吞吐
不适合
独立运行
规模
27B · 未知 · Q4 ~18GB / FP16 ~65GB
授权
Apache-2.0 · 需自查
框架
llama.cpp
血统
量化自 Qwen3.8-27B
可信度
下载 26k,llama.cpp 已合并 PR #27342,实测接受长度 5.39 (Q4_K_M)

快速上手示例

ollama run hf.co/z-lab/Qwen3.8-27B-DFlash2-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   5 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-08-24)

作者
z-lab
任务类型
text-generation
推理库
llama.cpp
下载
26,007
点赞
84
许可证
Apache-2.0
标签
llama.cpp, gguf, dflash2, speculative-decoding, draft-model, text-generation, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, region:us, conversational

探索

源链接