🎨Sneak-Moose / Pro-Realism-Edit-Studio
基于Qwen-Image-Edit-2511和Rapid-AIO加速变压器的图像编辑工具,支持单张或两张输入图像,通过提示词生成高质量编辑结果。
运行模型 Qwen/Qwen-Image-Edit-2511 ↗
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
基于Qwen-Image-Edit-2511和Rapid-AIO加速变压器的图像编辑工具,支持单张或两张输入图像,通过提示词生成高质量编辑结果。
运行模型 Qwen/Qwen-Image-Edit-2511 ↗
Krea 2文本到图像生成demo,提供Raw和Turbo蒸馏版本,运行在ZeroGPU上。
MOSS-Transcribe-Diarize 0.9B端到端音频理解模型,联合语音转录和说话人分离,生成带时间戳和匿名说话人标签的结构化转录,适用于会议、通话等长时多说话人录音。
运行模型 OpenMOSS-Team/MOSS-transcribe-diarize ↗
4D人脸重建与跟踪工具,从图像序列或视频前40帧中一次前馈预测深度和面部坐标,输出带跟踪的点云,支持两种推理模式。
运行模型 depth-anything/DA3-GIANT-1.1 ↗
户外照片重光照工具,通过交互式3D球拖动太阳方向,两遍生成(阴天去除阴影+太阳方向匹配)实现重光照。
运行模型 eric-venti-seeds/Sun-Direction-Lora-Flux2Klein9B →
FLUX.1 [schnell] 的文本生成图像演示:12B 参数 rectified flow Transformer,经潜在对抗扩散蒸馏,1 至 4 步生成图像,Apache-2.0 许可,可商用。
运行模型 black-forest-labs/FLUX.1-schnell ↗
LivePortrait 的官方 PyTorch 实现:将驱动视频中的人脸运动迁移到静态人像上,实现人像动画,具备拼接与重定向控制;仓库提供预训练权重和使用说明。
DALL·E Mini 的演示:根据文本提示生成图像,面向研究与个人使用;其中 DALL·E Mega 是最大版本,可用于创意等下游场景。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索