Dramabox (ResembleAI)
通用文本转语音,面向配音与有声内容制作者
任务 语音合成最近核对 2026-06-19
适合与不适合
独立证据与社区反馈
社区认为 DramaBox 是当前表现力最强的开源 TTS 之一,语音表现力明显优于旧方案,且支持本地运行与 ComfyUI 集成,但受限于 LTX-2.3 的许可证与短片段训练限制。
- 通过自然语言 prompt 控制情感、呼吸与语气,替代传统的标签/参数调参方式
- 从约 10 秒参考音频即可完成语音克隆
- 在 ComfyUI 中本地运行,降低延迟并融入视频生成管线
- 以轻量模型提供比多数竞品更快的推理速度和更好的情感一致性
- 基础模型 LTX-2.3 音频分支仅训练在 ≤~20 秒片段上,长文本生成可能受限
- LTX-2 Community License 存在商业使用门槛(如 10M 下载量限制)
- 克隆效果依赖参考音频质量,差音频会导致输出劣化
- 独立评测ComfyUI DramaBox AI Build a Local TTS - The Best Open Source TTS in 2026?
- 独立评测DramaBox TTS: Saving drama for the performance, not the security review
- 社区实测Most Expressive Voice model ever based on LTX 2.3 : r/LocalLLaMA
- 独立评测What Is DramaBox by Resemble AI? Open-Source Emotional Text-to-Speech Explained
- 转载/仓库GitHub - resemble-ai/DramaBox: super expressive prompting model based on ltx2.3 · GitHub
可信度HuggingFace 下载量 869,点赞 96
完整规格
观测时间线
模型家族
- LTX-2.3
- 微调 Dramabox (ResembleAI)
- LoRA LTX-Best-Face-ID (Alissonerdx)
- 量化 Sulphur-2-base (SulphurAI)