模型 / Gemma4-12B-Uncensored (HauhauCS)

Gemma4-12B-Uncensored (HauhauCS)

解除审查的Gemma4多模态模型,面向代理编码与创意写作

作者 HauhauCS

仓库标识HauhauCS/Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced

显存未知许可 限制商用任务 智能体最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
llama.cpp
下载
2,056

Hugging Face 源仓库 ↗

适合与不适合

入选理由
提供现成GGUF和视觉模型,可在llama.cpp等工具直接运行。基于Gemma4量化并移除审查,适合追求无限制对话和编程的用户。
对位
对位 Llama-3.2-11B-Vision
适合
代理式编码与工具调用 / 创意写作与角色扮演
不适合
要求绝对零拒绝的严格场景

独立证据与社区反馈

9 个独立来源 · 另 2 官方/转载最近验证 2026-08-05

HauhauCS 的 Balanced 版本被社区广泛推荐为本地部署首选,体感更像是偏重创意写作、角色扮演和情感对话的模型,而非硬核编程工具。QAT 版通过 MTP 实现约 60% 生成加速,在 7-8 GB 显存即可跑 80K 上下文,门槛低、性价比高。

  • 去除拒绝/审查,标准使用中未发现拒答,仅极少数边缘 prompt 首次回避、二次请求服从
  • MTP 推测解码带来约 60% 生成速度提升,质量不变
  • 低显存部署:~7.7 GB VRAM 跑 80K 上下文,围绕 16 GB 机器设计
  • 统一多模态:视觉、视频、音频在一个模型中,无编码器,打破开源多模态模型本地运行与能力二选一的困境
  • 创意写作、角色扮演、情感对话表现突出,被明确标注为最佳适用场景
  • 文档视觉问答(DocVQA)表现强劲,受益于无编码器空间 token 编码
  • 易消融/易去审查:社区反馈在发布后 90 分钟内即可完成消融,简单系统提示词即可绕过审查
  • 编程能力普遍不如同尺寸竞品(如 Qwen 3.6 35B A3B),尤其智能体编程场景差距明显
  • QAT 版在长上下文实战中 compaction 后容易迷失,需要大量人工推动
  • 部分边缘 prompt 首次会回避,需重新提问或策略性措辞才能获得完整输出
  • "优于两倍大模型"说法仅限同家族内比较(对比 Gemma 3 27B),不代表超越其他实验室同尺寸模型
  • 非 QAT 版在工具调用上存在问题,实际对比中输出代码但功能未实现
  • E2B 版本音频处理存在问题,作者标注后续需要修复

可信度社区uncensored变体,下载量2k,声明0/465拒绝,基于官方QAT权重

完整规格

规模
12B · 256K · 权重格式未知,无法估算显存
授权
gemma · 限制商用
框架
llama.cpp / LM Studio / Jan / koboldcpp
血统
量化自 gemma-4-12B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 445.4k → 648.2k · likes +61

观测时间线

模型家族

查看全部家族 →