🏆TencentARC / Pixal3D
从单张图像生成高保真3D资产的工具,采用像素反投影建立像素到3D对应,输出包含详细几何和 PBR 纹理的 GLB 网格。
运行模型 TencentARC/Pixal3D
从单张图像生成高保真3D资产的工具,采用像素反投影建立像素到3D对应,输出包含详细几何和 PBR 纹理的 GLB 网格。
运行模型 TencentARC/Pixal3D
Gemma 4 E4B-IT的无审查版本,模型完全解锁不会拒绝提示,使用importance matrix量化保留质量,支持llama.cpp等运行时。
轻量级文本转语音系统,完全本地运行(ONNX Runtime),无需云端,支持31种语言,改进阅读稳定性,提供预设语音风格,开源权重。
快速图像编辑 demo,结合 FireRed-Image-Edit 与 Qwen-Image-Edit-Rapid,采用 Transformer 架构实现文本引导编辑。
提示驱动的TTS模型,支持语音克隆,基于LTX-2.3 3.3B音频模型的IC-LoRA微调,通过提示控制说话人身份、情感、笑叹暂停等,可选10秒参考音频克隆音色,峰值显存约24GB。
运行模型 ResembleAI/Dramabox
集成 Lightricks 22B 视频生成模型 LTX-2.3 的 Gradio 应用,提供文本/图像/音频/唇同步/关键帧/风格六种生成模式,并支持 IC-LoRA 细节增强。
运行模型 Lightricks/LTX-2.3
← 前一日 不可用 · 后一日 2026-05-21 →
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索