Nemotron-Labs-Diffusion-14B (NVIDIA)
三模式 LM (AR/扩散/自推测),为 AI 应用开发者提供高效生成
~8.1GB 4-bit任务 文本生成最近核对 2026-06-28
适合与不适合
独立证据与社区反馈
技术架构新颖(三模态),但社区实际使用率低,多数讨论停留在技术介绍层面
- 同一模型支持自回归与扩散两种解码方式,可通过切换注意力模式实现
- 针对Nvidia硬件优化,支持TensorRT检查点以提升推理性能
- 社区实际使用案例稀少,有用户直接质疑是否有人真正在用
- 部分讨论将其与图像生成模型(eDiffi/DALL-E)混淆,存在认知偏差
- 社区实测Nemotron-Labs-Diffusion from NVIDIA : r/LocalLLaMA - Reddit
- 社区实测Nvidia releases Nemotron-Labs-Diffusion, a tri-mode language model
- 社区实测NVIDIA Nemotron — does anyone actually use it? - Reddit
- 转载/仓库GitHub - NVlabs/Nemotron-Labs-Diffusion · GitHub
可信度自推测接受长度 3× vs Qwen3-8B-Eagle3,DGX Spark 上 2.7× 加速 (w4a16)
完整规格
下载动量
30天下载 12.7k → 13.3k · likes +4