模型 / VibeVoice-ASR-Streaming-7B (Microsoft)

VibeVoice-ASR-Streaming-7B (Microsoft)

流式说话人归属语音转写,支持10语言与热词

作者 microsoft

仓库标识microsoft/VibeVoice-ASR-Streaming-7B

显存未知许可 可商用任务 语音识别最近核对 2026-09-07
运行内存
权重格式未知,无法估算显存
运行时
transformers
下载
889

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
流式ASR新模型,支持说话人分离与自定义热词,十种语言,有在线demo可即时试用,适合会议纪要等场景。
适合
实时会议多说话人转写 / 含专有名词的流式语音识别
不适合
低显存端侧离线转写

完整规格

规模
7B · 权重格式未知,无法估算显存
授权
MIT · 可商用
框架
transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.4k → 5.6k

观测时间线