此页是 2026-08-22 的观测快照,查看该模型当前信息 → /m/z-lab__qwen38-27b-dflash2/

归档 / 2026-08-22 / Qwen3.8-27B-DFlash2-GGUF (incoai)

Qwen3.8-27B-DFlash2-GGUF (incoai)

llama.cpp 投机解码草稿模型 GGUF

入选理由
DFlash2 是 Qwen3.8-27B 的投机解码草稿模型,GGUF 已发布但需自编译 llama.cpp PR 分支才能运行。采用 block-diffusion 并行草拟架构,可无损加速解码,适合关注推理吞吐的开发者。
对位
适合
配合 Qwen3.8-27B 加速投机解码 / llama.cpp 下无损投机解码
不适合
不适合单独作为语言模型使用
规模
27B · 未知 · Q4 ~18GB / FP16 ~65GB
授权
apache-2.0 · 需自查
框架
llama.cpp
血统
量化自 Qwen3.8-27B
可信度
HF 下载 26.1k,点赞 94,llama.cpp PR #27342 支持

快速上手示例

ollama run hf.co/incoai/Qwen3.8-27B-DFlash2-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   5 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-08-22)

作者
incoai
任务类型
text-generation
推理库
llama.cpp
下载
26,100
点赞
94
许可证
apache-2.0
标签
llama.cpp, gguf, dflash2, speculative-decoding, draft-model, text-generation, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, region:us, conversational

探索

源链接