scenema-audio (ScenemaAI)
TTS 模型,面向语音合成开发者
仅 safetensors · 无 pickle 加载风险
社区实测
项目宣称零样本表现力语音克隆,但社区关注度极低(109星、几乎无独立讨论),尚处早期阶段。
- 零样本表现力语音克隆(zero-shot expressive voice cloning)
- 将 TTS、通用音频生成与语音克隆整合进单一扩散管线(diffusion-based pipeline)
- 原生克隆(native cloning)方案仍在探索替代路线,当前方案可能并非最终形态
- 社区关注度极低,缺乏独立验证与实测反馈
来源
Scenema Audio: Zero-shot expressive voice cloning and speech generation (r/LocalLLaMA)Scenema Audio: Zero-shot expressive voice cloning and speech generation (r/StableDiffusion)Instagram — ScenemaAI's Open-Source Audio ModelFacebook — Scenema Audio open-sources zero-shot expressive voice cloning
截至 2026-06-21