模型 / SuperGemma4-26B (Jiunsong)

SuperGemma4-26B (Jiunsong)

Gemma4 26B 无审查 MLX, 本地代理加速

作者 Jiunsong

~15GB 4-bit许可 限制商用任务 智能体最近核对 2026-06-21
格式
4-bit
文件
~13GB
运行内存
~15GB–20GB
运行时
MLX_LM
下载
25,653

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

mlx_lm.server --model Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
提供MLX命令行与OpenAI兼容接口,可快速部署;下载量2.5万+社区采用;基于Gemma4微调优化,benchmark提升
对位
vs 原版 Gemma 4 26B IT 量化
适合
代码与工具使用代理 / 无审查对话与指令跟随
不适合
视觉或多模态任务

独立证据与社区反馈

7 个独立来源 · 另 2 官方/转载最近验证 2026-06-21

SuperGemma4-26B 是 Gemma 4 26B 的社区无审查微调版,在基准分数和推理速度上均优于原版,对 Apple Silicon(MLX)和 GGUF 生态支持良好,适合本地 agent 工作流。但工具调用稳定性两极分化明显,部分用户遭遇循环卡死,且输出质量对 temperature 敏感,31B 模型在同等量化下被认为更强。

  • 去除审查拒绝,实现真正的无审查输出
  • 推理速度相比原版 Gemma 4 26B 提升约 8.7%
  • 综合基准分数从 91.4 提升至 95.8,逻辑单项从 86.9 提升至 95.2
  • 提供 MLX 4-bit 版本,可在 Apple Silicon Mac 上作为 OpenAI 兼容服务器本地运行
  • 提供 GGUF v2 版本,支持 llama.cpp、LM Studio、Jan、Open WebUI 等非 Mac 平台
  • 可与 Hermes Agent 配合用于终端优先的本地 AI 工作流
  • 可与 OpenClaw 连接作为本地推理模型用于助手和自动化任务
  • 一次性编程任务表现突出,在特定基准中得分接近 GPT 5.2 和 Gemini 3 Pro Preview
  • 韩语能力相比原版有所提升(+4.3)
  • 在 64GB Mac 上运行速度合理,不会过度占用系统资源
  • 工具调用不可靠,4-bit 变体经常漏掉工具调用并陷入参数猜测循环
  • 使用工具和自定义 harness 写代码时表现反而比一次性生成更差
  • 部分用户按模型卡推荐设置运行仍遇到模型输出异常或「坏掉」的情况
  • 编程任务需将 temperature 降至 0.3 或更低,默认高温下容易产生大量低级错误
  • 24GB 统一内存是最低舒适门槛,推荐 32GB 及以上
  • 同家族的 31B 模型在同等量化下被认为明显更强
  • 代码分析任务可能产生大量琐碎错误,有用户称之为「用过最差的模型」
  • 2B-4B 等更小尺寸版本不支持工具调用

可信度下载 2.5 万, bench 95.8, 生成 46.2 tok/s

完整规格

规模
26B (4-bit) · 下载 ~13GB · 显存最低 ~15GB · 推荐 ~20GB · 4-bit(估算)
授权
gemma · 限制商用
框架
mlx
血统
量化自 gemma-4-26B-A4B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 18k → 16.4k · likes +13

观测时间线

模型家族

查看全部家族 →