此页是 2026-07-29 的观测快照,查看该模型当前信息 → /m/nvidia__qwen-image-flash/

归档 / 2026-07-29 / Qwen-Image-Flash (NVIDIA)

Qwen-Image-Flash (NVIDIA)

四步DMD2蒸馏,快速文本生成图像,开发者评估

入选理由
Qwen-Image 的 4 步蒸馏版,速度提升 10倍+,质量接近原版,适合高吞吐场景,需大显存(20B参数)。
对位
对位 Flux-Dev 等开源大模型
适合
少步文生图研究与评估 / 低延迟创意内容生成
不适合
图像编辑、理解与安全决策
规模
20.43B · 未知 · Q4 ~13GB / FP16 ~49GB
授权
NVIDIA Open Model Agreement · 需自查
框架
diffusers / sglang / vllm / tensorrt-llm
图像
基于 Qwen-Image
可信度
Qwen-Image-Bench 47.08,NVIDIA官方蒸馏,四步评估

快速上手示例

sglang generate --model-path nvidia/Qwen-Image-Flash --prompt "A red fox in a snowy pine forest at golden hour, photorealistic, sharp focus, soft bokeh" --width 1024 --height 1024 --num-inference-steps 4 --guidance-scale 1.0 --true-cfg-scale 1.0 --seed 42 --save-output --output-file-path qwen-image-flash-sglang.png

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   4 / 5
总分
10

HuggingFace 原始数据 (抓取于 2026-07-29)

作者
nvidia
任务类型
text-to-image
推理库
diffusers
下载
366
点赞
58
许可证
NVIDIA Open Model Agreement
标签
diffusers, safetensors, nvidia, ModelOpt, AutoModel, qwen-image, dmd2, few-step, text-to-image, arxiv:2508.02324, arxiv:2405.14867, arxiv:2605.28091, base_model:Qwen/Qwen-Image, base_model:finetune:Qwen/Qwen-Image, license:other, diffusers:QwenImagePipeline, region:us

探索

源链接