scenema-audio (ScenemaAI)
TTS 模型,面向语音合成开发者
仓库标识ScenemaAI/scenema-audio
任务 语音合成最近核对 2026-08-09
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
适合与不适合
独立证据与社区反馈
输出比 Gemini 3.1 Flash TTS 更自然、更少机器人感
- 语音合成输出更自然、更少机器人感
- 零样本表情语音克隆,支持情感弧线、节奏、呼吸控制与意图表达
- 支持全片生成,保持语音和角色一致性
- 模型权重使用 LTX-2 Community License,非完全开放
- 社区实测r/LocalLLaMA on Reddit: Scenema Audio: Zero-shot expressive voice cloning and speech generation
- 社区实测r/MachineLearning on Reddit: Scenema Audio: Zero-shot expressive voice cloning and speech generation [N]
- 社区实测r/huggingface on Reddit: Scenema Audio: Zero-shot expressive voice cloning and speech generation
- 独立评测scenema-audio: Text-to-Audio model — overview, use cases, alternatives
- 社区实测r/generativeAI on Reddit: What is the best entry level Ai video maker for 30secs-3mins in your opinion?
可信度Hugging Face 下载量 176,点赞 65
完整规格
下载动量
30天下载 127 → 101