模型 / Gemma-4-31B-Animus-V15.0-GGUF (Darkhn)

Gemma-4-31B-Animus-V15.0-GGUF (Darkhn)

Wings of Fire 世界观角色扮演, 支持链式思维

作者 Darkhn-Quants-4

~19GB 4-bit许可 可商用最近核对 2026-07-15
格式
4-bit
文件
~16GB
运行内存
~19GB–24GB
运行时
OLLAMA
下载
5,924

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
基于Gemma-4-31B的GGUF角色扮演微调,带链式思考推理,适合沉浸式叙事和Wings of Fire同人创作;需16GB以上显存。
对位
对位 Qwen2.5-32B
适合
WoF/奇幻世界观叙事 / 推理链辅助角色扮演
不适合
通用问答/编程

独立证据与社区反馈

8 个独立来源 · 另 2 官方/转载最近验证 2026-07-15

Gemma 4 31B 社区口碑总体正面,在本地可部署的规模下提供了接近前沿模型的综合能力,Arena 排名靠前;但深度推理仍不及闭源旗舰,部署时硬件发热明显。Animus 微调版在文案与创意写作上增强了情感理解力,但仓库被标记为含敏感内容。

  • 本地编程辅助,可作为日常编码协作者
  • 文案与创意写作,尤其适合需要情感表达的场景
  • 极低拒答率,几乎无安全审查导致的拒绝
  • 在单 GPU 或笔记本上即可运行,无需高端服务器
  • 31B 参数规模下基准测试成绩可匹敌 20 倍体积的模型
  • 写作时展现出更丰富的情感理解力
  • 偶有超过尖端闭源模型(如 Opus 4.7)的表现
  • 深度推理仍不及前沿闭源模型
  • 笔记本高负载运行时发热严重
  • 长上下文下低精度量化可能因 KV 缓存复用导致误差积累
  • 对比之下让部分用户更认可 Qwen 系列的质量
  • Animus 微调版仓库在 HuggingFace 上被标记为含敏感内容

可信度下载量 5924, 基于 google/gemma-4-31B-it 微调, 训练数据 122M tokens

完整规格

规模
31B · 下载 ~16GB · 显存最低 ~19GB · 推荐 ~24GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
ollama / llama.cpp / koboldcpp
血统
量化自 Gemma-4-31B-Animus-V15.0
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 5.9k → 7.6k

观测时间线