Qwen3.8-27B-DFlash2 (z-lab)
为 Qwen3.8-27B 提供投机解码加速的草案模型
仓库标识z-lab/Qwen3.8-27B-DFlash2
~1.2GB 4-bit许可 可商用任务 文本生成最近核对 2026-08-24
仅 safetensors · 无 pickle 加载风险
- 格式
- 4-bit
- 文件
- ~1GB
- 运行内存
- ~1.2GB–1.5GB
- 运行时
- VLLM
- 下载
- 50,763
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve Qwen/Qwen3.8-27B --speculative-config '{"method":"dflash","model":"z-lab/Qwen3.8-27B-DFlash2","num_speculative_tokens":7}' 依赖版本和硬件参数请以源仓库说明为准。
- 格式
- 4-bit
- 文件
- ~1GB
- 运行内存
- ~1.2GB–1.5GB
- 运行时
- PYTHON
- 下载
- 1,484
仅 safetensors · 无 pickle 加载风险
快速上手示例
python -m sglang.launch_server --model-path Qwen/Qwen3.8-27B --speculative-algorithm DFLASH --speculative-draft-model-path incoai/Qwen3.8-27B-DFlash2 --speculative-num-draft-tokens 8 依赖版本和硬件参数请以源仓库说明为准。
- 格式
- 4-bit
- 文件
- ~14GB
- 运行内存
- ~16GB–21GB
- 运行时
- OLLAMA
- 下载
- 26,100
快速上手示例
ollama run hf.co/incoai/Qwen3.8-27B-DFlash2-GGUF 依赖版本和硬件参数请以源仓库说明为准。
- 格式
- 4-bit
- 文件
- ~14GB
- 运行内存
- ~16GB–21GB
- 运行时
- OLLAMA
- 下载
- 26,007
快速上手示例
ollama run hf.co/z-lab/Qwen3.8-27B-DFlash2-GGUF 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
完整规格
下载动量
30天下载 65k → 187.6k
观测时间线
模型家族
- Qwen3.8-27B
- 量化 Dirk-Qwen3.8-27B (peculiar-ragdoll)
- 量化 Huihui-Qwen3.8-27B-abliterated-GGUF (huihui-ai)
- 量化 Qwen3.8-27B (ISTA-DASLab)
- 量化 Qwen3.8-27B (LM Studio)
- 量化 Qwen3.8-27B (Qwen)
- 量化 Qwen3.8-27B Heretic Abliterated GGUF (0bserverx)
- 量化 Qwen3.8-27B MTPLX (Youssofal)
- 微调 Qwen3.8-27B-DFlash2 (z-lab)
- 量化 Qwen3.8-27B-Escha-W2 (Escha)
- 量化 Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal)
- 量化 Qwen3.8-27B-OBLITERATED (OBLITERATUS)
- 量化 Qwen3.8-27B-Ridge-GGUF (empero-ai)
- 量化 Qwen3.8-27B-Uncensored-GGUF (orcarouter)
- 量化 Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF (HauhauCS)
- 量化 Qwen3.8-Whittle-MoE-27B-A17.8B (logic65)