🎙️multimodalart / scenema-audio 零样本表现力语音克隆与生成,支持情感、语速和呼吸控制,基于音频扩散 Transformer,需下载约 38GB 模型权重。 收藏 28 · 2个月前更新 gradio 运行中 详情