模型 / SuperGemma4-26B-Uncensored (Jiunsong)

SuperGemma4-26B-Uncensored (Jiunsong)

无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理

作者 Jiunsong

~16GB 4-bit许可 限制商用任务 智能体最近核对 2026-07-22
格式
4-bit
文件
~14GB
运行内存
~16GB–20GB
运行时
OLLAMA
下载
267,449

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/Jiunsong/supergemma4-26b-uncensored-gguf-v2

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
提供GGUF可直接本地运行,下载量26万有外部佐证,相比原版有benchmark提升
对位
对位官方 Gemma-4-26B-it 及其他无审查版本
适合
本地苹果硅无审查对话 / 快速编程与韩语任务
不适合
需严格内容审核的场景

独立证据与社区反馈

8 个独立来源 · 另 3 官方/转载最近验证 2026-07-22

社区普遍认为这是目前最实用的本地无审查 Gemma 4 变体之一,26B 规模兼顾速度与响应能力,配合 MLX/GGUF 双格式在 Mac 和 Windows/Linux 上部署门槛较低。

  • 实际无内容审查,社区验证确实"uncensored"
  • 不会把日常对话强行路由到代码模式,对话体验自然
  • 支持韩语等多语言,韩语推理速度达 222 tok/s
  • 在实用文本任务上比原始基座模型更强
  • QuickBench 得分从基座 91.4 提升至 95.8
  • 推理速度从基座 42.5 tok/s 提升至 46.2 tok/s
  • 提示词处理速度提升 90%
  • 与 Hermes、OpenClaw、OpenCode 等本地 agent 工具配合良好
  • GGUF Q4_K_M 格式兼容 llama.cpp、LM Studio、Jan、Open WebUI 等
  • 提供 MLX 版本,可在 Apple Silicon 上运行本地 OpenAI 兼容服务
  • 存在重复输出问题,llama.cpp 用户社区讨论中反馈了此问题
  • VRAM 需求较高,18-22 GB 显存,24GB 统一内存为最低舒适门槛,32GB 更佳
  • 模型有时会先绕弯子再给出直接回答,并非完全直出

可信度下载26万+,点赞624;M4 Max韩语生成89.4 tok/s,整体bench 95.8

完整规格

规模
26B · 下载 ~14GB · 显存最低 ~16GB · 推荐 ~20GB · 4-bit(估算)
授权
gemma · 限制商用
框架
llama.cpp / ollama
血统
量化自 gemma-4-26B-A4B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 74.9k → 63.4k · likes +75

观测时间线

模型家族

查看全部家族 →