模型 / FLUX.1-dev (BFL)

FLUX.1-dev (BFL)

文本到图像生成,用于开发者与创作者的视觉内容创建

作者
black-forest-labs
对位
对位 Stable Diffusion 3, Midjourney v6
适合
高质量文本到图像生成 / 复杂语义与文字渲染
不适合
低显存或实时生成场景
入选理由
可通过 Hugging Face Space 或 API 直接试用。
规模
12B · 不适用 · 最低 ~7.2GB · 4-bit(估算)
授权
非商业许可 · 需自查
框架
diffusers / ComfyUI
国内访问
需代理
可信度
HuggingFace 下载 70.8 万,点赞 1.29 万

社区实测

FLUX.1-dev 被广泛视为最强大的开放权重图像生成模型,画质接近旗舰闭源版 Pro,照片级真实感可与 Midjourney 媲美,支撑了数百个第三方平台和 ComfyUI 工作流,但其非商业许可始终是生产环境部署的最大障碍。

  • 提供接近闭源旗舰模型(Pro)的图像质量,同时以开放权重形式发布
  • 照片级真实感可与 Midjourney 正面竞争
  • 能渲染可读的文字,解决了此前扩散模型普遍无法生成清晰文本的痛点
  • 12B 参数模型可在消费级硬件上运行,降低部署门槛
  • 与 ComfyUI、HuggingFace Diffusers、TensorRT 等主流推理框架开箱即兼容
  • 衍生出丰富的工具生态:Fill(修补)、Canny/Depth(结构控制)、Redux(图像变体)、Kontext(图像编辑)
  • 通过 SaladCloud 等 GPU 云平台可实现低成本批量推理,约 992 张/美元
  • 社区 LoRA 训练生态成熟,fal 平台提供当时最快的 LoRA 训练器
  • FLUX.1-dev 使用非商业许可,不能用于商业用途或商业服务
  • 部分社区模型将 dev 与 Schnell 合并后以 Apache 等商业友好许可分发,存在法律风险
  • 生成速度比同系列的 Schnell 慢约 4 倍
  • 约需 20 步推理才能产出高质量图像,对低配硬件仍有算力压力
  • 社区 LoRA 与衍生模型(如 Krea-dev)的兼容性不保证,迁移需实测验证

截至 2026-06-21

本形态 ~7.2GB 4-bit · 国内 需代理 · 708,162 下载

仅 safetensors · 无 pickle 加载风险

快速上手

diffusers: FluxPipeline.from_pretrained('black-forest-labs/FLUX.1-dev')

本形态源 ↗

观测时间线