模型 / Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)

Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)

Gemma4 无审查多模态 MoE,面向创意写作与角色扮演

作者 HauhauCS

~16GB 4-bit许可 可商用任务 智能体最近核对 2026-07-22
格式
4-bit
文件
~14GB
运行内存
~16GB–20GB
运行时
llama.cpp
下载
40,301

Hugging Face 源仓库 ↗

适合与不适合

入选理由
GGUF格式可直接运行;本质是微调去审查非新能力。
对位
对位 Google Gemma-4-26B-it,去除安全审查
适合
创意写作与角色扮演 / 多模态图片-文本对话
不适合
高复杂度 agentic 编程任务

独立证据与社区反馈

5 个独立来源 · 另 1 官方/转载最近验证 2026-07-22

社区普遍认为 Balanced 变体是实用默认选择,几乎消除了拒绝回答,同时保留了原版 Gemma4-26B 的强劲性能,尤其适合创意写作和角色扮演;但边缘提示词仍需 re-ask 才能通过,且作者拒绝与社区对话引发了一些不满。

  • 近乎零拒绝的标准使用体验,仅少数边缘提示词需要在追问后通过
  • 创意写作、角色扮演、情感智能表现突出
  • 一次性编程任务得分接近 GPT-5.2 和 Gemini 3 Pro Preview
  • MTP 加速带来 35%-53% 的推理速度提升
  • MoE 架构下推理速度反而快于部分更小模型
  • 基准测试成绩与 31B 稠密模型差距在 2% 以内
  • 256K 原生上下文窗口
  • 兼容 llama.cpp、vLLM、Unsloth Studio 等主流推理框架
  • 少数边缘提示词首次仍会拒绝,需追问后通过
  • 部分拒绝行为仍残留在专家权重中
  • 作者拒绝与社区对话或讨论,引发信任顾虑
  • 首次输出可能先给出拒绝性回复再转向,体验不够流畅
  • 部分用户对该模型持保留态度,口碑不一
  • 使用工具链进行编程时表现劣于一次性直接输出代码

可信度HuggingFace 40k+ 下载,0/465 拒答测试结果,基于 google/gemma-4-26B-A4B-it

完整规格

规模
26B (25.2B total, 3.8B active) · 256K · 下载 ~14GB · 显存最低 ~16GB · 推荐 ~20GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
llama.cpp / LM Studio / koboldcpp
血统
量化自 gemma-4-26B-A4B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 126.7k → 95.6k · likes +25

观测时间线

模型家族

查看全部家族 →