模型 / Nemotron-Labs-Audex-30B-A3B (NVIDIA)

Nemotron-Labs-Audex-30B-A3B (NVIDIA)

音频-文本统一LLM,兼顾文本推理与语音/音频生成

作者 nvidia

~18GB 4-bit许可 需自查任务 文本生成最近核对 2026-07-09
格式
4-bit
文件
~16GB
运行内存
~18GB–23GB
运行时
vllm

Hugging Face 源仓库 ↗

适合与不适合

入选理由
统一音频-文本MoE模型,支持理解、识别、翻译、生成及语音交互,需vLLM和多卡推理。适合有算力的开发者。
对位
对位 3B级稠密模型(如Qwen2.5-3B)
适合
音频理解、语音识别与翻译 / 文本-语音/音频生成与对话
不适合
商业部署(非商业许可)

完整规格

规模
30B MoE (3B激活) · 1M · 下载 ~16GB · 显存最低 ~18GB · 推荐 ~23GB · 4-bit(估算)
授权
NVIDIA Oneway Noncommercial License · 需自查
框架
vllm / transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.3k → 2.3k

观测时间线