此页是 2026-05-16 的观测快照,查看该模型当前信息 → /m/resembleai__dramabox/

归档 / 2026-05-16 / Dramabox (ResembleAI)

Dramabox (ResembleAI)

通用文本转语音,面向配音与有声内容制作者

入选理由
有HF Space可试用;微调新增语音克隆能力,但非创新架构。
对位
对位 Bark、XTTS-v2
适合
多角色配音生成 / 有声书合成
不适合
低延迟实时语音场景
规模
未知 · 不适用
授权
other
框架
huggingface_hub
血统
微调自 LTX-2.3
可信度
HuggingFace 下载量 869,点赞 96

仅 safetensors · 无 pickle 加载风险

社区实测

社区认为 DramaBox 是当前表现力最强的开源 TTS 之一,语音表现力明显优于旧方案,且支持本地运行与 ComfyUI 集成,但受限于 LTX-2.3 的许可证与短片段训练限制。

  • 通过自然语言 prompt 控制情感、呼吸与语气,替代传统的标签/参数调参方式
  • 从约 10 秒参考音频即可完成语音克隆
  • 在 ComfyUI 中本地运行,降低延迟并融入视频生成管线
  • 以轻量模型提供比多数竞品更快的推理速度和更好的情感一致性
  • 基础模型 LTX-2.3 音频分支仅训练在 ≤~20 秒片段上,长文本生成可能受限
  • LTX-2 Community License 存在商业使用门槛(如 10M 下载量限制)
  • 克隆效果依赖参考音频质量,差音频会导致输出劣化

截至 2026-06-19

快速上手

snapshot_download('ResembleAI/Dramabox')

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-05-16)

作者
ResembleAI
任务类型
text-to-speech
推理库
ltx-audio-tts
下载
869
点赞
96
许可证
other
标签
ltx-audio-tts, dramabox-tts, tts, voice-cloning, audio-generation, diffusion-transformer, flow-matching, ltx-2, text-to-speech, en, base_model:Lightricks/LTX-2.3, base_model:finetune:Lightricks/LTX-2.3, license:other, region:us

探索

源链接