模型 / scenema-audio (ScenemaAI)

scenema-audio (ScenemaAI)

TTS 模型,面向语音合成开发者

作者 ScenemaAI

仓库标识ScenemaAI/scenema-audio

任务 语音合成最近核对 2026-08-09
运行时
未公开
下载
176

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
需自建Docker无现成API;情感控制与场景感知。
对位
对位 Bark、VITS 等 TTS 方案
适合
文本转语音合成 / AI 语音内容制作
不适合
高并发实时语音服务

独立证据与社区反馈

5 个独立来源最近验证 2026-08-09

输出比 Gemini 3.1 Flash TTS 更自然、更少机器人感

  • 语音合成输出更自然、更少机器人感
  • 零样本表情语音克隆,支持情感弧线、节奏、呼吸控制与意图表达
  • 支持全片生成,保持语音和角色一致性
  • 模型权重使用 LTX-2 Community License,非完全开放

可信度Hugging Face 下载量 176,点赞 65

完整规格

授权
other
框架
未公开
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 127 → 101

观测时间线