模型 / Granite-4.1-8B-GGUF (IBM)

Granite-4.1-8B-GGUF (IBM)

IBM Granite 4.1 8B的GGUF量化,用于本地推理

作者 lmstudio-community

~4.8GB 4-bit许可 可商用任务 文本生成最近核对 2026-06-21
格式
4-bit
文件
~4.2GB
运行内存
~4.8GB–6.2GB
运行时
llama.cpp
下载
1,015

Hugging Face 源仓库 ↗

适合与不适合

入选理由
GGUF格式可直接运行;本质是量化重打包。
对位
对位 Llama-3.1-8B
适合
本地CPU推理 / 低资源设备文本生成
不适合
高并发生产环境

独立证据与社区反馈

4 个独立来源最近验证 2026-06-21

社区对这款企业级开源小模型有一定兴趣,实测反馈分化:部分用户认可其在轻量任务上的实用性,但也有用户对其较小变体的表现和数据时效性持保留态度。

  • 企业级开源小模型,可本地部署运行
  • 适合代码自动补全等轻量任务
  • 工具调用能力得到增强
  • 较小变体(如4B)在部分用户场景下表现不佳
  • 训练数据时效性存疑,可能影响实际使用意愿

可信度HF下载1015,由LM Studio使用llama.cpp b8994量化

完整规格

规模
8B · 下载 ~4.2GB · 显存最低 ~4.8GB · 推荐 ~6.2GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
llama.cpp / LM Studio / ollama
血统
量化自 granite-4.1-8b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 5.5k → 5.5k

观测时间线