模型 / Supertonic 3 (Supertone)

Supertonic 3 (Supertone)

31种语言本地TTS,面向AI应用开发者的语音合成

作者 Supertone

~0.1GB 4-bit许可 限制商用任务 语音合成最近核对 2026-07-22
格式
4-bit
文件
~0.1GB
运行内存
~0.1GB
运行时
ONNX Runtime
下载
16,496

Hugging Face 源仓库 ↗

适合与不适合

入选理由
有Python SDK和HF Space可试用;多语言扩展与朗读稳定性改进。
对位
对比VoxCPM2等大模型,更小尺寸本地运行
适合
多语言离线语音合成 / 低资源设备端实时TTS
不适合
语音克隆与高拟真度需求

独立证据与社区反馈

4 个独立来源最近验证 2026-07-22

66M 参数的轻量级 TTS,速度极快,但快模式音质差、质量模式仍带合成感

  • 本地/端侧运行 TTS,无需网络,保护隐私
  • 极致推理速度,RTX4090 上实时率 0.001,M4 Pro 上 0.006
  • 66M 超轻量参数,适合边缘设备和浏览器端部署
  • 支持 C++/Python/JS/Java/Rust/Go/Swift 等 8+ 语言 SDK 嵌入
  • Supertonic 3 通过流式分块拼接,首音延迟可压到 1 秒以内
  • 快模式(fast mode)被社区评价为「快但差」
  • 质量模式(quality mode)清晰可懂但仍略带合成感

可信度16k下载,258赞,99M参数ONNX模型,支持31语言

完整规格

规模
99M · 下载 ~0.1GB · 显存最低 ~0.1GB · 4-bit(估算)
授权
OpenRAIL-M · 模型 限制商用 · 输出 可商用
框架
ONNX Runtime / supertonic
访问提示
Hugging Face 可能需要代理

观测时间线