此页是 2026-08-29 的观测快照,查看该模型当前信息 → /m/incoai__glm-53-flash-dflash2/
归档 / 2026-08-29 / GLM-5.3-Flash-DFlash2 (incoai)
GLM-5.3-Flash-DFlash2 (incoai)
为 GLM-5.3-Flash 推理加速的 DFlash2 草稿模型
- 入选理由
- DFlash2是GLM-5.3-Flash的投机解码草稿模型,需配合SGLang服务使用,可提升解码速度2倍左右。适合追求推理性能的开发者。
- 对位
- 适合
- GLM-5.3-Flash 投机解码加速 / 提高 GLM-5.3-Flash 生成吞吐
- 不适合
- 独立文本生成
- 规模
- 1.2B · 未知 · Q4 ~0.8GB / FP16 ~2.8GB
- 授权
- CC BY-NC-ND 4.0 · 需自查
- 框架
- sglang
- 血统
- 微调自 GLM-5.3-Flash
- 可信度
- HuggingFace 3253 次下载、81 点赞;模型卡含 SGLang 启动参数与加速数据
仅 safetensors · 无 pickle 加载风险
快速上手示例
sglang serve --model-path zai-org/GLM-5.3-Flash --trust-remote-code --speculative-algorithm DFLASH --speculative-draft-model-path incoai/GLM-5.3-Flash-DFlash2 --speculative-draft-attention-backend fa4 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 5 / 5
- 总分
- 9
HuggingFace 原始数据 (抓取于 2026-08-29)
- 作者
- incoai
- 推理库
- transformers
- 下载
- 3,253
- 点赞
- 81
- 许可证
- CC BY-NC-ND 4.0
- 标签
- transformers, safetensors, qwen3, dflash, dflash2, speculative-decoding, block-diffusion, draft-model, sglang, text-generation, base_model:zai-org/GLM-5.3-Flash, base_model:finetune:zai-org/GLM-5.3-Flash, license:cc-by-nc-nd-4.0, text-generation-inference, region:us
探索
源链接