模型 / Granite-4.1-30B (IBM)

Granite-4.1-30B (IBM)

IBM Granite 30B GGUF量化, 本地部署与推理

作者 lmstudio-community

~18GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-22
格式
4-bit
文件
~16GB
运行内存
~18GB–23GB
运行时
llama.cpp
下载
982

Hugging Face 源仓库 ↗

适合与不适合

入选理由
有GGUF格式可直接运行;仅量化重打包,非新模型。
对位
对位Qwen2.5-32B等30B级开源模型
适合
本地推理与微调基线 / 通用文本生成与对话
不适合
需高精度、无损推理的任务

独立证据与社区反馈

1 个独立来源最近验证 2026-07-22

独立来源不足,尚未形成社区共识:社区讨论极少,关注度被 Qwen3.6 / Gemma4 盖过,定位为不需要推理的紧凑场景用模型

  • 密集架构(非 MoE),在该尺寸档位部分用户偏好密集模型
  • 官方定位为不需要推理但需要严格 token 预算的紧凑用例
  • 无推理能力,不适合复杂任务
  • 社区实测反馈极少,实际表现难以评估

可信度HF下载量982, 基于IBM Granite官方模型, Apache 2.0许可, llama.cpp b8994量化

完整规格

规模
30B · 下载 ~16GB · 显存最低 ~18GB · 推荐 ~23GB · 4-bit(估算)
授权
Apache 2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 granite-4.1-30b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 3k → 2.9k

观测时间线