SummFlow 2026-06-08 Hugging Face

🍲multimodalart / MisoTTS

文本转语音与声音克隆,8B参数,基于Sesame CSM架构,使用Llama 3.2风格骨干和自回归音频解码器,生成Mimi音频码。

运行模型 MisoLabs/MisoTTS

收藏 19 · 1个月前更新
  • gradio
  • 运行中
详情 查看源

🎬signsur4739379373 / LTX-2.3-10Eros

图片转视频,支持原生音频生成,基于LTX 2.3 audio-video模型和fp8 checkpoint,运行Comfy工作流,可关闭音频输出静音MP4。

收藏 24 · 1个月前更新
  • gradio
  • 运行中
详情

❤️hexgrad / Kokoro-TTS

Kokoro文本转语音demo,已升级至v1.0版本。

收藏 3.3k · 1年前更新
  • gradio
  • 运行中
详情

👕Kwai-Kolors / Kolors-Virtual-Try-On

收藏 10k · 3个月前更新
  • gradio
  • 运行中
详情