⚡dayona / I2V-EXTENDED
基于 FastAPI 与 Uvicorn 的 API 服务器:提供文本/图像生成视频的提示增强(Wan 2.1/2.2)、InsightFace 换脸(含性别过滤)及 GFPGAN v1.4 人脸修复。
运行模型 ezioruan/inswapper_128.onnx ↗
收藏 34 · 21天前更新
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
基于 FastAPI 与 Uvicorn 的 API 服务器:提供文本/图像生成视频的提示增强(Wan 2.1/2.2)、InsightFace 换脸(含性别过滤)及 GFPGAN v1.4 人脸修复。
运行模型 ezioruan/inswapper_128.onnx ↗
MiniMax Music 3 音乐生成 demo:输入歌词与结构化音乐描述,生成最长五分钟完整歌曲,输出 32kHz/16-bit 立体声 WAV;使用 8B 全局 LLM、0.6B 局部 LLM 和 Flow Matching/Flow-VAE。
运行模型 MiniMaxAI/MiniMax-Music3 ↗
OpenAI 开源的 encoder–decoder Transformer 通用语音识别与翻译模型,68 万小时多语言多任务弱监督训练,在嘈杂、多口音与跨语言转写上鲁棒性强。
运行模型 openai/whisper-large-v3 →
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索