🍊multimodalart / Boogu-Image
基于指令的图像编辑 demo,模型为 Boogu-Image-0.1,Apache-2.0 开源,支持文本到图像生成、快速生成、图像编辑及中英文文本渲染。
基于指令的图像编辑 demo,模型为 Boogu-Image-0.1,Apache-2.0 开源,支持文本到图像生成、快速生成、图像编辑及中英文文本渲染。
使用多个 FLUX.2-Klein LoRA 的 demo,实验性空间,可能记录图像上传用于性能监控,图像 7 天后自动删除。
通过单一提示创建 AI 漫画的开源项目,需前端、后端、LLM、SDXL 等组件;底层使用 Zephyr-7B-β(基于 Mistral-7B 的 DPO 微调模型)。
腾讯发布的 3D 合成系统,包含形状生成模型 Hunyuan3D-DiT(基于可扩展流扩散 Transformer)和纹理合成模型 Hunyuan3D-Paint,支持文本到 3D 和图像到 3D。
运行模型 tencent/Hunyuan3D-2
12B 参数 rectified flow transformer 的文本到图像生成模型,使用引导蒸馏训练,输出质量接近 FLUX.1 [pro],非商业许可。
非官方的 F5-TTS 和 E2-TTS 零样本语音克隆 demo,基于 Flow Matching 的语音生成技术。
运行模型 SWivid/F5-TTS
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索