模型 / Nemotron-Labs-Audex-2B (NVIDIA)

Nemotron-Labs-Audex-2B (NVIDIA)

统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成

作者 nvidia

~1.2GB 4-bit许可 需自查任务 文本生成最近核对 2026-07-22
格式
4-bit
文件
~1GB
运行内存
~1.2GB–1.6GB
运行时
vllm
下载
1,050

Hugging Face 源仓库 ↗

适合与不适合

入选理由
统一音频文本的多任务模型,支持理解、识别、翻译、TTS和音频生成,128K上下文,需自建vLLM环境且仅限非商业使用。
适合
语音识别与翻译、音频问答 / 文本转语音、音频生成
不适合
商业用途 (非商用许可)

独立证据与社区反馈

1 个独立来源最近验证 2026-07-22

独立来源不足,尚未形成社区共识:社区讨论度极低,几乎无人提及,远不如 Gemma 4 或 Qwen 受关注

  • 社区讨论度极低,实际使用反馈稀缺

可信度NVIDIA 发布,技术报告 arXiv:2607.05196,兼容 vLLM 与 transformers

完整规格

规模
2B · 128k · 下载 ~1GB · 显存最低 ~1.2GB · 推荐 ~1.6GB · 4-bit(估算)
授权
NVIDIA OneWay Noncommercial License · 需自查
框架
vllm / transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.7k → 2.4k

观测时间线