Granite-4.1-30B (IBM)
IBM Granite 30B GGUF量化, 本地部署与推理
~18GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-22
- 格式
- 4-bit
- 文件
- ~16GB
- 运行内存
- ~18GB–23GB
- 运行时
- llama.cpp
- 下载
- 982
适合与不适合
独立证据与社区反馈
独立来源不足,尚未形成社区共识:社区讨论极少,关注度被 Qwen3.6 / Gemma4 盖过,定位为不需要推理的紧凑场景用模型
- 密集架构(非 MoE),在该尺寸档位部分用户偏好密集模型
- 官方定位为不需要推理但需要严格 token 预算的紧凑用例
- 无推理能力,不适合复杂任务
- 社区实测反馈极少,实际表现难以评估
可信度HF下载量982, 基于IBM Granite官方模型, Apache 2.0许可, llama.cpp b8994量化
完整规格
下载动量
30天下载 3k → 2.9k