模型 / Qwen-Image-Flash (NVIDIA)

Qwen-Image-Flash (NVIDIA)

四步DMD2蒸馏,快速文本生成图像,开发者评估

作者 nvidia

仓库标识nvidia/Qwen-Image-Flash

~12GB 4-bit许可 需自查任务 图像生成最近核对 2026-07-29
格式
4-bit
文件
~11GB
运行内存
~12GB–16GB
运行时
SGLANG
下载
366

Hugging Face 源仓库 ↗

快速上手示例

sglang generate --model-path nvidia/Qwen-Image-Flash --prompt "A red fox in a snowy pine forest at golden hour, photorealistic, sharp focus, soft bokeh" --width 1024 --height 1024 --num-inference-steps 4 --guidance-scale 1.0 --true-cfg-scale 1.0 --seed 42 --save-output --output-file-path qwen-image-flash-sglang.png

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen-Image 的 4 步蒸馏版,速度提升 10倍+,质量接近原版,适合高吞吐场景,需大显存(20B参数)。
对位
对位 Flux-Dev 等开源大模型
适合
少步文生图研究与评估 / 低延迟创意内容生成
不适合
图像编辑、理解与安全决策

完整规格

规模
20.43B · 下载 ~11GB · 显存最低 ~12GB · 推荐 ~16GB · 4-bit(估算)
授权
NVIDIA Open Model Agreement · 需自查
框架
diffusers / sglang / vllm / tensorrt-llm
图像
基于 Qwen-Image
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 987 → 585 · likes +10

观测时间线