🚀HiDream-ai / HiDream-O1-Image
基于像素级统一Transformer(UiT)的图像生成基础模型,无需外部VAE或文本编码器,支持文本到图像、图像编辑和主体驱动个性化,最高2048×2048分辨率,内置推理驱动提示代理。
2026-05-21
基于像素级统一Transformer(UiT)的图像生成基础模型,无需外部VAE或文本编码器,支持文本到图像、图像编辑和主体驱动个性化,最高2048×2048分辨率,内置推理驱动提示代理。
多语言零样本文本到语音模型,支持600+语言,基于扩散语言模型架构,支持语音克隆和语音设计。
运行模型 k2-fsa/OmniVoice
演示Qwen图像编辑LoRA集合的应用。