模型 / Gemma-4-31B-StyleTune (Gryphe)

Gemma-4-31B-StyleTune (Gryphe)

Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。

作者 Gryphe

~20GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-22
格式
4-bit
文件
~17GB
运行内存
~20GB–25GB
运行时
transformers
下载
278

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
针对Gemma 4的轻量风格微调,只改变输出层减少陈词滥调,保留原能力。适合角色扮演/创意写作用户。需自写推理代码,显存要求高。
对位
对位 Qwen2.5-32B / Command R+ 32B
适合
低陈词滥调角色扮演 / 创意写作与叙事生成
不适合
正式文书写作与代码生成

独立证据与社区反馈

8 个独立来源最近验证 2026-07-22

Gemma 4 31B 是 2026 年最重要的开源模型之一,Apache 2.0 许可证降低了企业采用门槛,同体量下编程能力突出,在 one-shot 编码任务中得分接近 GPT 5.2 与 Gemini 3 Pro Preview。开启推理后表现令人惊艳,思维链简洁连贯,视觉理解与多语言表现也好,但不开推理时质量明显下降,深度推理仍不及 Sonnet/Opus 等前沿闭源模型,KV cache 占用大且审查较严。

  • 本地编程助手场景表现好,适合作为日常编码辅助
  • 代码结构理解力强,能准确把握代码各部分如何协同工作
  • 开启推理后表现大幅提升,远超不开推理时
  • 同体量下编程能力突出,one-shot 编码得分接近 GPT 5.2 与 Gemini 3 Pro Preview
  • 思维链简洁、有用、连贯,不会像其他模型那样内部自相矛盾或循环
  • 视觉理解能力好
  • 多语言表现好
  • Apache 2.0 许可证消除了企业采用顾虑,是 2026 年最重要的开源发布之一
  • 通过了 7/8 个真实生产环境测试
  • 简单到中等任务可考虑用于生产环境,为首个让用户认真考虑上生产的开源模型
  • 深度推理仍不及 Sonnet/Opus 等前沿闭源模型
  • 不开推理时表现明显下降,质量较差
  • KV cache 占用巨大,未做足够的压缩优化
  • 审查/拒答严重,尤其对医疗建议类请求几乎全部拒绝
  • 使用工具和自定义 harness 写代码时表现比 one-shot 差
  • Google AI Studio 版本表现很差,不如本地 GGUF 量化版,存在 tokenizer 问题
  • heretic 和 abliterated 等修改版会损害模型性能

可信度基于200个角色扮演prompt基准,陈词减少60%,共享三元组仅21.7%,作者有MythoMax等作品。

完整规格

规模
31B · 下载 ~17GB · 显存最低 ~20GB · 推荐 ~25GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
transformers
血统
微调自 gemma-4-31B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2.4k → 2.4k · likes +16

观测时间线

模型家族

查看全部家族 →