此页是 2026-08-29 的观测快照,查看该模型当前信息 → /m/incoai__glm-53-flash-dflash2/

归档 / 2026-08-29 / GLM-5.3-Flash-DFlash2 (incoai)

GLM-5.3-Flash-DFlash2 (incoai)

为 GLM-5.3-Flash 推理加速的 DFlash2 草稿模型

入选理由
DFlash2是GLM-5.3-Flash的投机解码草稿模型,需配合SGLang服务使用,可提升解码速度2倍左右。适合追求推理性能的开发者。
对位
适合
GLM-5.3-Flash 投机解码加速 / 提高 GLM-5.3-Flash 生成吞吐
不适合
独立文本生成
规模
1.2B · 未知 · Q4 ~0.8GB / FP16 ~2.8GB
授权
CC BY-NC-ND 4.0 · 需自查
框架
sglang
血统
微调自 GLM-5.3-Flash
可信度
HuggingFace 3253 次下载、81 点赞;模型卡含 SGLang 启动参数与加速数据

仅 safetensors · 无 pickle 加载风险

快速上手示例

sglang serve --model-path zai-org/GLM-5.3-Flash --trust-remote-code --speculative-algorithm DFLASH --speculative-draft-model-path incoai/GLM-5.3-Flash-DFlash2 --speculative-draft-attention-backend fa4

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-29)

作者
incoai
任务类型
text-generation
推理库
transformers
下载
3,253
点赞
81
许可证
CC BY-NC-ND 4.0
标签
transformers, safetensors, qwen3, dflash, dflash2, speculative-decoding, block-diffusion, draft-model, sglang, text-generation, base_model:zai-org/GLM-5.3-Flash, base_model:finetune:zai-org/GLM-5.3-Flash, license:cc-by-nc-nd-4.0, text-generation-inference, region:us

探索

源链接