模型 / MisoTTS-8B (MisoLabs)

MisoTTS-8B (MisoLabs)

基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续

作者 MisoLabs

仓库标识MisoLabs/MisoTTS

显存未知许可 需自查任务 语音合成最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
pytorch

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
基于Sesame CSM架构的TTS模型,提供推理代码和演示地址。
对位
对位 Sesame CSM 开源实现
适合
高质量对话语音合成 / 从短音频提示生成语音延续
不适合
长篇有声书朗读

独立证据与社区反馈

1 个独立来源最近验证 2026-08-09

独立来源不足,尚未形成社区共识:音色讨喜,但稳定性是主要短板:连很短的文本都会出现幻觉,社区建议优先解决输出一致性。

  • TTS 输出一致性不足,极短文本也会产生幻觉
  • 有用户认为这类规模仍不够稳定,稳定性问题比想象中明显

可信度Hugging Face 76 点赞,骨干为 Llama-8B 加 Sesame CSM 架构

完整规格

规模
8B · 2048 · 权重格式未知,无法估算显存
授权
other · 需自查
框架
pytorch
语种
未声明
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 0 → 0 · likes +6

在线体验

观测时间线