🐌r3gm / wan2-2-fp8da-aoti-preview-2
输入图像和文本提示,生成对应视频。
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
输入图像和文本提示,生成对应视频。
输入单张2D图像,输出可变数量的3D高斯表示,用于三维场景重建,由TripoAI开发。
运行模型 VAST-AI/TripoSplat ↗
基于 Transformers 的图像编辑 demo,结合 FireRed-Image-Edit 和 Qwen-Image-Edit-Rapid。
集成 Lightricks 22B 视频生成模型 LTX-2.3 的 Gradio 应用,提供文本/图像/音频/唇同步/关键帧/风格六种生成模式,并支持 IC-LoRA 细节增强。
运行模型 Lightricks/LTX-2.3 ↗
NVIDIA 的 16B 参数全模态世界模型 demo,支持文本或图像生成视频及同步音频,基于 Diffusers Cosmos3OmniPipeline。
聊天机器人 demo,运行 Qwen3.5-4B 混合线性注意力模型 GGUF,通过 llama-cpp-python 推理,支持 ZeroGPU 和 WebGPU 两种部署方式。
运行模型 AlexWortega/qwen35-4b-soyuz-merged-gguf ↗
从单张图像生成高保真3D资产的工具,采用像素反投影建立像素到3D对应,输出包含详细几何和 PBR 纹理的 GLB 网格。
运行模型 TencentARC/Pixal3D ↗
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索