此页是 2026-07-22 的观测快照,查看该模型当前信息 → /m/nineninesix__diamond-10/
归档 / 2026-07-22 / Diamond-1.0 (nineninesix)
Diamond-1.0 (nineninesix)
语音恢复:劣化音频→44.1kHz近棚音,用于数据集清洗
- 入选理由
- 提供在线Space直接试用,专为语音恢复设计的自回归RQ-Transformer架构,从零训练,适合需要提升老旧录音质量的开发者。
- 对位
- 对位 Resemble Enhance、RE-USE 等语音恢复模型
- 适合
- 劣化语音数据集清洗 / 播客、采访、档案音频修复
- 不适合
- 实时流式处理或法医取证用途
- 规模
- 166.6M · 未知 · Q4 ~0.1GB / FP16 ~0.4GB
- 授权
- Apache-2.0 · 需自查
- 框架
- PyTorch
- 可信度
- 从零训练166.6M参数,基准测试六款开源模型中第二,DNSMOS OVRL平均+0.255
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 5 / 5
- 总分
- 11
HuggingFace 原始数据 (抓取于 2026-07-22)
- 作者
- nineninesix
- 推理库
- 未指定
- 下载
- 0
- 点赞
- 55
- 许可证
- Apache-2.0
- 标签
- speech-restoration, speech-enhancement, audio-to-audio, autoregressive, neural-audio-codec, audio, arxiv:2306.06546, arxiv:2203.01941, arxiv:2410.00037, arxiv:2306.05284, arxiv:2305.18802, arxiv:2110.01763, license:apache-2.0, region:us
探索
源链接