空间 / multimodalart / scenema-audio

🎙️multimodalart / scenema-audio

零样本表现力语音克隆与生成,支持情感、语速和呼吸控制,基于音频扩散 Transformer,需下载约 38GB 模型权重。

作者
multimodalart
SDK
gradio
状态
运行中
收藏
28

观测时间线