模型 / gemma-4-E4B-it (Google)

gemma-4-E4B-it (Google)

Gemma4-4B-it 量化版, 本地轻量推理

作者 lmstudio-community

仓库标识lmstudio-community/gemma-4-E4B-it-GGUF

显存未知许可 可商用最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
llama.cpp
下载
1,229,116

Hugging Face 源仓库 ↗

适合与不适合

入选理由
GGUF格式可直接运行;下载量超百万;量化版本无新能力
对位
对位 Llama-3.2-3B、Phi-3-mini
适合
本地轻量指令跟随与聊天 / 消费级 GPU/CPU 推理
不适合
复杂推理与多语言长文本

独立证据与社区反馈

9 个独立来源 · 另 1 官方/转载最近验证 2026-08-09

E4B 是本地部署的安全起点,Q4_K_M 量化版体积与性能平衡良好,可在手机上运行;非编码任务表现不错,但编码能力明显不如 Qwen3.5 系列,且 API 路由速度存在短板。

  • Q4_K_M 量化版文件体积适中、性能可用,是本地部署的好选择
  • 可在手机上通过 termux+llama.cpp 以 Q4_K_M 量化运行,达到 7t/s
  • 首 token 延迟仅 0.88s,在同尺寸开放权重模型中极具竞争力(中位数 2.14s)
  • 面向移动和边缘设备部署场景设计
  • E4B 在特定 benchmark 上达 42.5%,较上一代同尺寸模型翻倍
  • 被推荐为最安全的本地使用起点
  • 在 npcsh benchmark 中表现甚至不如 Gemma 3 4B
  • 代码生成存在语法错误,如多余括号、逗号分隔函数定义
  • 编码能力不如 Qwen3.5 系列
  • OpenRouter 上 E4B 路由的 token 速度极慢,近乎不可用

可信度下载 122 万, Google 官方权重, llama.cpp 量化

完整规格

规模
4B · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 gemma-4-E4B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 624k → 587.4k · likes +5

观测时间线

模型家族

查看全部家族 →