模型 / Nemotron-Labs-Audex-30B-A3B (NVIDIA)

Nemotron-Labs-Audex-30B-A3B (NVIDIA)

音频-文本统一LLM,兼顾文本推理与语音/音频生成

作者 nvidia

仓库标识nvidia/Nemotron-Labs-Audex-30B-A3B

显存未知许可 需自查任务 文本生成最近核对 2026-08-02
运行内存
权重格式未知,无法估算显存
运行时
vllm

Hugging Face 源仓库 ↗

适合与不适合

入选理由
统一音频-文本MoE模型,支持理解、识别、翻译、生成及语音交互,需vLLM和多卡推理。适合有算力的开发者。
对位
对位 3B级稠密模型(如Qwen2.5-3B)
适合
音频理解、语音识别与翻译 / 文本-语音/音频生成与对话
不适合
商业部署(非商业许可)

独立证据与社区反馈

2 个独立来源最近验证 2026-08-02

社区关注度低,实测反馈两极分化:部分用户能在消费级硬件上流畅运行,推理速度可观,但代码任务质量不佳、幻觉明显。

  • 可在 16GB 显存的消费级 GPU(如 AMD 9060 XT)上直接运行,无需额外调优
  • 推理速度在 M4 Pro 上达到约 90 token/s,足以满足日常使用
  • 幻觉率 9.6%,在其参数规模下接近更大的 Qwen3-Next-80B-A3B-Thinking(9.3%)
  • 代码分析任务幻觉严重,给定代码库后立即开始编造信息,无法替代真正的编码 agent
  • 30B 参数却命名为 'Nano',社区普遍认为名称具有误导性
  • 社区讨论度和实际采用率远低于 Qwen / Gemma 等同期竞品
  • 无法装入 RTX 5090,对高端消费级显卡的部署仍有门槛

可信度NVIDIA发布,技术报告arXiv:2607.05196,提供vLLM/HF推理脚本及复现步骤

完整规格

规模
30B MoE (3B激活) · 1M · 权重格式未知,无法估算显存
授权
NVIDIA Oneway Noncommercial License · 需自查
框架
vllm / transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 621 → 515 · likes +2

在线体验

观测时间线