scenema-audio (ScenemaAI)
TTS 模型,面向语音合成开发者
任务 语音合成最近核对 2026-07-22
适合与不适合
独立证据与社区反馈
开发者自述可实现零样本语音克隆,能分离语音身份与情感表现,但社区独立实测反馈极少。
- 用数秒参考音频即可克隆语音身份
- 语音身份与情感表现分离,情感由文本提示驱动
- 开发者自述 ID-LORA 方案质量很差
- 模型文件较大(全精度约 9.8GB,INT8 约 4.9GB)
- 是扩散模型而非传统 TTS 管线,开发者提及存在常见问题但未具体列出
- 独立评测Scenema Audio: Zero-Shot Expressive Voice Cloning and Speech Generation | Scenema AI
- 社区实测Scenema Audio: Zero-shot expressive voice cloning and ...
- 社区实测Scenema Audio: Zero-shot expressive voice cloning and ...
- 官方/厂商ScenemaAI/scenema-audio · Hugging Face
可信度Hugging Face 下载量 176,点赞 65
完整规格
下载动量
30天下载 65 → 71 · likes +4