此页是 2026-05-23 的观测快照,查看该模型当前信息 → /m/microsoft__lens-turbo/

归档 / 2026-05-23 / Lens-Turbo (Microsoft)

Lens-Turbo (Microsoft)

3.8B 高效文生图,4 步蒸馏,为开发者与创作者快速生成

入选理由
可本地跑官方示例,但无一键部署接口;Turbo版为4步蒸馏,有速度优势但非突破性创新。
对位
对位 FLUX.1-dev、SD3.5 等快速文生图模型
适合
快速 4 步高分辨率图像生成 / 多语言提示与宽高比灵活生成
不适合
商业产品或服务部署
规模
3.8B · 未知
授权
MIT · 可商用
框架
diffusers / transformers
可信度
微软出品,3.8B MMDiT,4 步采样,支持 1440x1440,论文 arxiv 2605.21573

社区实测

Lens-Turbo 是一款 3.8B 参数的高效文生图模型,以远低于同类模型的训练算力实现有竞争力的画质,在 ComfyUI 中集成体验流畅、出图速度快,但 20B 文本编码器对显存有一定要求且缺乏图像编辑能力。

  • 快速出图,适合追求低延迟的生成场景
  • 低显存运行,对硬件门槛相对友好
  • 训练效率极高,所需算力约为同类模型的五分之一
  • ComfyUI 集成顺畅,模型切换方便
  • 以 3.8B 小参数量实现与 FLUX、SD3 等大模型竞争甚至超越的画质
  • 提供 Turbo/Base/Dev 三个变体满足不同速度与质量需求
  • 文本编码器体积达 20B,加载和推理开销较大
  • 不支持图像编辑/inpainting 等能力,功能较单一
  • 16GB 显存能否流畅运行存在疑问

截至 2026-06-21

快速上手

CLI: git clone https://github.com/microsoft/Lens && python inference.py --repo_id microsoft/Lens-Turbo

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-05-23)

作者
microsoft
任务类型
text-to-image
推理库
diffusers
下载
116
点赞
48
许可证
MIT
标签
diffusers, safetensors, text-to-image, en, arxiv:2605.21573, license:mit, diffusers:LensPipeline, region:us

探索

源链接