任务类型 · text-to-speech

共 25 个 (跨 21 天)

2026-09-12

AuK-1.5B (Tencent) 开源语音生成与编辑基础模型,支持零样本 TTS

2026-09-11

AuK (Tencent) 1.5B 语音生成与编辑模型,支持零样本 TTS

2026-08-27

Breeze-TTS-2 (BreezeBlue) 中英文实时TTS,支持语音克隆/设计/定向

2026-08-24

Audio8-TTS-0.1B (Audio8) 0.17B 零样本语音克隆,中英为主多语种 TTS

2026-08-14

IndexTTS-2.5 (IndexTeam) 零样本语音克隆,支持中英日西阿,单音频参考

2026-08-03

Fish Audio S2 Pro (Fish Audio) 多语种TTS,细粒度韵律/情感内联控制,80+语言

2026-07-31

Audio8-TTS-Preview-0.6b (Audio8) 0.6B多语言TTS,零样本语音克隆,支持11种语言 SakThai-TTS (Nanthasit) 15语TTS GGUF,离线CPU运行

2026-07-27

Inflect-Nano-v2 (Owensong) 4M参数本地英文TTS,CPU实时推理

2026-07-26

Inflect-Micro-v2 (owensong) 9.36M 参数完整本地 TTS,固定男声英语言语合成

2026-07-10

Gepard-1.0 (nineninesix) 流式自回归 TTS,面向实时对话与语音代理

2026-07-09

Kokoro-82M (hexgrad) 82M 参数轻量 TTS 模型,支持多语言,可本地部署

2026-07-03

Higgs TTS 3 (Boson AI) 对话式语音合成,100+语种,零样本克隆与内联控制

2026-06-24

MOSS-TTS-Local-Transformer-v1.5 (OpenMOSS) 零样本声音克隆多语言TTS模型,支持31种语言和本地部署

2026-06-20

Inflect-Nano-v1 (owensong) 超小型英文TTS,总4.63M参数,适合本地/嵌入式实验

2026-06-14

ZONOS2 (Zyphra) 基于 MoE 的多语言 TTS,支持零样本克隆与流式生成

2026-06-06

Higgs-Audio-v3-TTS-4B (Boson AI) 语音对话TTS:100+语种、零样克隆、情感/风格内联控制

2026-06-05

MisoTTS-8B (MisoLabs) 基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续

2026-05-30

Qwen3-TTS-12Hz-1.7B-CustomVoice (Qwen) 指令式多语言TTS,流式延迟低至97ms,9音色

2026-05-29

MOSS-TTS-v1.5 (OpenMOSS) 零样本语音克隆多语言TTS模型,支持31种语言及显式暂停控制。

2026-05-18

Irodori-TTS-500M-v3 (Aratako) 日语TTS,表情符号控制风格,零样本克隆

2026-05-16

Dramabox (ResembleAI) 通用文本转语音,面向配音与有声内容制作者 scenema-audio (ScenemaAI) TTS 模型,面向语音合成开发者 Supertonic 3 (Supertone) 31种语言本地TTS,面向AI应用开发者的语音合成 OmniVoice (k2-fsa) 为开发者提供600+语言零样本语音合成