🐌r3gm / wan2-2-fp8da-aoti-preview-2
Wan2.2是由阿里云通义实验室开发的、采用混合专家(MoE)架构、具备电影级美学控制能力的开源视频生成模型,能将文本或图像高效转化为高质量动态视频,采用Apache 2.0许可证。
Wan2.2是由阿里云通义实验室开发的、采用混合专家(MoE)架构、具备电影级美学控制能力的开源视频生成模型,能将文本或图像高效转化为高质量动态视频,采用Apache 2.0许可证。
TripoAI 开源并由 VAST-AI 托管的单图像转 3D Gaussian Splat 模型,只需一张 2D 图就能生成可控粒子数量的高质量 3D 高斯点云资产,适合作为 ComfyUI 等现代 3D/游戏管线里的轻量级 I2-3D 模块。
运行模型 VAST-AI/TripoSplat
快速图像编辑 demo,结合 FireRed-Image-Edit 与 Qwen-Image-Edit-Rapid,采用 Transformer 架构实现文本引导编辑。
集成 Lightricks 22B 视频生成模型 LTX-2.3 的 Gradio 应用,提供文本/图像/音频/唇同步/关键帧/风格六种生成模式,并支持 IC-LoRA 细节增强。
运行模型 Lightricks/LTX-2.3
NVIDIA 的 16B 参数全模态世界模型 demo,支持文本或图像生成视频及同步音频,基于 Diffusers Cosmos3OmniPipeline。
运行模型 nvidia/Cosmos3-Nano
聊天机器人 demo,运行 Qwen3.5-4B 混合线性注意力模型 GGUF,通过 llama-cpp-python 推理,支持 ZeroGPU 和 WebGPU 两种部署方式。
从单张图像生成高保真3D资产的工具,采用像素反投影建立像素到3D对应,输出包含详细几何和 PBR 纹理的 GLB 网格。
运行模型 TencentARC/Pixal3D
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索