Nemotron-3-Nano-30B-A3B (NVIDIA)
4bit MoE本地运行于Apple Silicon
~33GB 8-bit许可 需自查任务 文本生成最近核对 2026-07-22
- 格式
- 8-bit
- 文件
- ~29GB
- 运行内存
- ~33GB–43GB
- 运行时
- MLX_LM
- 下载
- 855
仅 safetensors · 无 pickle 加载风险
快速上手示例
mlx_lm.generate --model mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
社区讨论极少,仅有的反馈指出该模型在基准测试上不及 GLM 4.7 Flash
- 采用混合 Mamba-Transformer MoE 架构,每次前向仅激活 3.2B 参数,兼顾长上下文保留与推理延迟
- 基准测试表现不及 GLM 4.7 Flash
- 独立评测A Technical Review of NVIDIA's Nemotron 3 Nano 30B A3B
- 社区实测Nvidia Nemotron 3-Nano 30B-A3B-BF16 | Hacker News
可信度MLX社区855下载,6基准全胜统一4bit量化
完整规格
下载动量
30天下载 855 → 767