空间 / multimodalart / scenema-audio

🎙️multimodalart / scenema-audio

零样本表现力语音克隆与生成,支持情感、语速和呼吸控制,基于音频扩散 Transformer,需下载约 38GB 模型权重。

休眠 状态观测于 2026-09-17

唤醒并体验 ↗ HF Space 源仓库 ↗

用途与交互

用途
音频·语音·音乐
输入
文本 · 音频
输出
音频
作者
multimodalart
SDK
gradio
收藏
28 · 观测于 2026-05-22
HF 项目更新
2026-05-16

历史记录

1 次历史卡片 · 2026-05-22