模型 / Gemma-4-E4B-Aggressive (HauhauCS)

Gemma-4-E4B-Aggressive (HauhauCS)

无审查的Gemma 4多模态模型,适合内容生成开发者

作者 HauhauCS

~2.4GB 4-bit许可 限制商用任务 视觉理解最近核对 2026-07-22
格式
4-bit
文件
~2.1GB
运行内存
~2.4GB–3.1GB
运行时
llama.cpp
下载
796,434

Hugging Face 源仓库 ↗

适合与不适合

入选理由
提供GGUF可直接本地运行;仅abliterated+量化无新能力。
对位
替代原版gemma-4-e4b-it及其他受限模型
适合
无审查的多模态聊天应用 / 本地图像/音频内容生成
不适合
需安全合规的生产环境

独立证据与社区反馈

5 个独立来源 · 另 2 官方/转载最近验证 2026-07-22

Gemma 4 E4B 的 HauhauCS 无审查版在社区获得较高关注(Reddit 228 赞),核心卖点是 0/465 次拒绝、完整保留原版多模态能力(text/image/video/audio)且无性能损失。小尺寸模型做到原生多模态 + 131K 上下文,在边缘设备上部署门槛低,但部分生态工具(Ollama/LM Studio)兼容性仍有小坑。

  • 完全消除审查拒绝,0/465 次拒绝且无能力损失,保留原版 Google 发布品质
  • 4B 级别原生多模态(text/image/video/audio),一个模型覆盖全部模态
  • 提供从 Q8 到 Q2 的全面 GGUF 量化版本,含 mmproj 文件支持视觉/音频
  • K_P 量化在仅增加 5-15% 体积下实现 1-2 个量化级别的质量提升
  • 兼容 llama.cpp、LM Studio 等主流 GGUF 运行环境
  • 131K 原生上下文窗口
  • KV 共享层降低显存占用
  • Apache 2.0 协议允许商用
  • 在推理、编码、多语言任务上表现突出
  • 模型体积小适合边缘/移动端本地部署
  • HuggingFace 上有 83 个 Space 在使用本模型
  • 可通过 Ollama 一键拉取运行
  • Ollama 需要用户自行调整才能正常使用
  • HuggingFace 硬件兼容性组件不识别 K_P 量化,需手动到 Files 页面查看全部下载
  • LM Studio 中 K_P 量化显示为"?"(仅外观问题,模型可正常加载)
  • 长上下文场景下的人工测试时间不如作者其他发布充分,可能在极端情况遇到边缘问题
  • Google 引入了类似 GenRM 的内部审查机制,其正无审查版本难度持续增加
  • Ollama 上的边缘模型仅支持纯音频或纯视觉,同时使用会崩溃,且剥离多模态的版本不推荐使用
  • 2B 版本(E2B)能力有限,不应期望匹敌 7B 以上模型

可信度79.6万下载,0/465拒绝,基于gemma-4-e4b-it

完整规格

规模
4B · 131k · 下载 ~2.1GB · 显存最低 ~2.4GB · 推荐 ~3.1GB · 4-bit(估算)
授权
Gemma · 限制商用
框架
llama.cpp / LM Studio / koboldcpp
血统
量化自 gemma-4-e4b-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 550.1k → 513.8k · likes +78

观测时间线

模型家族

查看全部家族 →