MOSS-TTS-v1.5 (OpenMOSS)
零样本语音克隆多语言TTS模型,支持31种语言及显式暂停控制。
~5.1GB 4-bit许可 可商用任务 语音合成最近核对 2026-07-19
- 格式
- 4-bit
- 文件
- ~4.4GB
- 运行内存
- ~5.1GB–6.6GB
- 运行时
- transformers
- 下载
- 5,447
仅 safetensors · 无 pickle 加载风险
适合与不适合
独立证据与社区反馈
MOSS-TTS-v1.5 被社区视为当前开源语音克隆的领先方案,综合表现优于 Fish Audio S2 Pro 和 Qwen 3 TTS
- 开源可商用的语音克隆(对比 Fish Audio 不可商用)
- 多语言合成能力(支持31种语言,含粤语、泰语等新增语言)
- 多推理后端支持(SGLang-Omni 和 vLLM-Omni 均已适配)
- 长参考音频场景下的稳定语音克隆
- 不指定语言标签时,部分语言质量可能相比 1.0 版本回退
- 生成质量对部署配置敏感,需调优才能达到最佳效果
- 社区实测this new Moss tts 1.5 is damn good with voice cloning : r ...
- 社区实测Moss tts 1.5 8b Examples. It is the currently best voice cloning ...
- 社区实测OpenMOSS-Team/MOSS-TTS-v1.5 · Hugging Face
- 转载/仓库MOSS‑TTS Family is an open‑source speech and sound generation ...
可信度论文arxiv 2603.18090,ModelScope可访问,支持31种语言零样本克隆。