模型 / Granite-4.1-3B-GGUF (IBM)

Granite-4.1-3B-GGUF (IBM)

IBM Granite 4.1 3B GGUF量化,本地推理与边缘部署

作者 lmstudio-community

~1.8GB 4-bit许可 可商用任务 文本生成最近核对 2026-06-19
格式
4-bit
文件
~1.6GB
运行内存
~1.8GB–2.3GB
运行时
llama.cpp
下载
582

Hugging Face 源仓库 ↗

适合与不适合

入选理由
GGUF格式可直接使用;仅为量化重打包。
对位
对位Phi-3-mini、Qwen2.5-3B
适合
本地CPU推理 / 轻量级文本生成助手
不适合
高精度推理或长上下文

独立证据与社区反馈

4 个独立来源最近验证 2026-06-19

社区认为 Granite 4.1 系列的核心卖点是「训练数据新 + 稳定可靠」,3B 版本以极低硬件门槛适合轻量任务,但在通用能力上不如更大参数的竞品。

  • 仅需约 3GB 内存即可运行 3B 模型,硬件门槛极低
  • 输出风格友好、安全,适合小企业集成到产品中,不易被越狱
  • 训练数据较新,适合代码自动补全等轻量任务
  • 通用场景下不如 Qwen 等更大模型,仅适合自动补全等小任务
  • 上下文填充后生成速度可能下降

可信度IBM Granite系列,Apache-2.0许可,HuggingFace 582次下载

完整规格

规模
3B · 下载 ~1.6GB · 显存最低 ~1.8GB · 推荐 ~2.3GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 granite-4.1-3b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 3.4k → 3.5k

观测时间线