此页是 2026-08-22 的观测快照,查看该模型当前信息 → /m/z-lab__qwen38-27b-dflash2/
归档 / 2026-08-22 / Qwen3.8-27B-DFlash2-GGUF (incoai)
Qwen3.8-27B-DFlash2-GGUF (incoai)
- 入选理由
- DFlash2 是 Qwen3.8-27B 的投机解码草稿模型,GGUF 已发布但需自编译 llama.cpp PR 分支才能运行。采用 block-diffusion 并行草拟架构,可无损加速解码,适合关注推理吞吐的开发者。
- 对位
- 适合
- 配合 Qwen3.8-27B 加速投机解码 / llama.cpp 下无损投机解码
- 不适合
- 不适合单独作为语言模型使用
- 规模
- 27B · 未知 · Q4 ~18GB / FP16 ~65GB
- 授权
- apache-2.0 · 需自查
- 框架
- llama.cpp
- 血统
- 量化自 Qwen3.8-27B
- 可信度
- HF 下载 26.1k,点赞 94,llama.cpp PR #27342 支持
快速上手示例
ollama run hf.co/incoai/Qwen3.8-27B-DFlash2-GGUF 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 3 / 5
- Q3
- 是新东西吗 5 / 5
- 总分
- 11
HuggingFace 原始数据 (抓取于 2026-08-22)
- 作者
- incoai
- 推理库
- llama.cpp
- 下载
- 26,100
- 点赞
- 94
- 许可证
- apache-2.0
- 标签
- llama.cpp, gguf, dflash2, speculative-decoding, draft-model, text-generation, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, region:us, conversational
探索
源链接