Dramabox (ResembleAI)
通用文本转语音,面向配音与有声内容制作者
仅 safetensors · 无 pickle 加载风险
社区实测
社区认为 DramaBox 是当前表现力最强的开源 TTS 之一,语音表现力明显优于旧方案,且支持本地运行与 ComfyUI 集成,但受限于 LTX-2.3 的许可证与短片段训练限制。
- 通过自然语言 prompt 控制情感、呼吸与语气,替代传统的标签/参数调参方式
- 从约 10 秒参考音频即可完成语音克隆
- 在 ComfyUI 中本地运行,降低延迟并融入视频生成管线
- 以轻量模型提供比多数竞品更快的推理速度和更好的情感一致性
- 基础模型 LTX-2.3 音频分支仅训练在 ≤~20 秒片段上,长文本生成可能受限
- LTX-2 Community License 存在商业使用门槛(如 10M 下载量限制)
- 克隆效果依赖参考音频质量,差音频会导致输出劣化
来源
ComfyUI DramaBox AI Build a Local TTS - The Best Open Source TTS in 2026?GitHub - resemble-ai/DramaBox: super expressive prompting model based on ltx2.3 · GitHubDramaBox TTS: Saving drama for the performance, not the security reviewMost Expressive Voice model ever based on LTX 2.3 : r/LocalLLaMAWhat Is DramaBox by Resemble AI? Open-Source Emotional Text-to-Speech Explained
截至 2026-06-19
快速上手
snapshot_download('ResembleAI/Dramabox')