此页是 2026-07-22 的观测快照,查看该模型当前信息 → /m/nineninesix__diamond-10/

归档 / 2026-07-22 / Diamond-1.0 (nineninesix)

Diamond-1.0 (nineninesix)

语音恢复:劣化音频→44.1kHz近棚音,用于数据集清洗

入选理由
提供在线Space直接试用,专为语音恢复设计的自回归RQ-Transformer架构,从零训练,适合需要提升老旧录音质量的开发者。
对位
对位 Resemble Enhance、RE-USE 等语音恢复模型
适合
劣化语音数据集清洗 / 播客、采访、档案音频修复
不适合
实时流式处理或法医取证用途
规模
166.6M · 未知 · Q4 ~0.1GB / FP16 ~0.4GB
授权
Apache-2.0 · 需自查
框架
PyTorch
可信度
从零训练166.6M参数,基准测试六款开源模型中第二,DNSMOS OVRL平均+0.255

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-07-22)

作者
nineninesix
任务类型
audio-to-audio
推理库
未指定
下载
0
点赞
55
许可证
Apache-2.0
标签
speech-restoration, speech-enhancement, audio-to-audio, autoregressive, neural-audio-codec, audio, arxiv:2306.06546, arxiv:2203.01941, arxiv:2410.00037, arxiv:2306.05284, arxiv:2305.18802, arxiv:2110.01763, license:apache-2.0, region:us

探索

源链接