空间 / multimodalart / MisoTTS

🍲multimodalart / MisoTTS

文本转语音与声音克隆,8B参数,基于Sesame CSM架构,使用Llama 3.2风格骨干和自回归音频解码器,生成Mimi音频码。

作者
multimodalart
SDK
gradio
状态
运行中
收藏
19
运行模型
MisoLabs/MisoTTS

观测时间线