模型 / Gemma-4-31B-Animus-V15.0-GGUF (Darkhn)

Gemma-4-31B-Animus-V15.0-GGUF (Darkhn)

Wings of Fire 世界观角色扮演, 支持链式思维

作者
Darkhn-Quants-4
对位
对位 Qwen2.5-32B
适合
WoF/奇幻世界观叙事 / 推理链辅助角色扮演
不适合
通用问答/编程
入选理由
基于Gemma-4-31B的GGUF角色扮演微调,带链式思考推理,适合沉浸式叙事和Wings of Fire同人创作;需16GB以上显存。
规模
31B · Q4 ~20GB / FP16 ~74GB
授权
Apache-2.0 · 需自查
框架
ollama / llama.cpp / koboldcpp
血统
量化自 Gemma-4-31B-Animus-V15.0
国内访问
需代理
可信度
下载量 5924, 基于 google/gemma-4-31B-it 微调, 训练数据 122M tokens

社区实测

Gemma 4 31B 社区口碑总体正面,在本地可部署的规模下提供了接近前沿模型的综合能力,Arena 排名靠前;但深度推理仍不及闭源旗舰,部署时硬件发热明显。Animus 微调版在文案与创意写作上增强了情感理解力,但仓库被标记为含敏感内容。

  • 本地编程辅助,可作为日常编码协作者
  • 文案与创意写作,尤其适合需要情感表达的场景
  • 极低拒答率,几乎无安全审查导致的拒绝
  • 在单 GPU 或笔记本上即可运行,无需高端服务器
  • 31B 参数规模下基准测试成绩可匹敌 20 倍体积的模型
  • 写作时展现出更丰富的情感理解力
  • 偶有超过尖端闭源模型(如 Opus 4.7)的表现
  • 深度推理仍不及前沿闭源模型
  • 笔记本高负载运行时发热严重
  • 长上下文下低精度量化可能因 KV 缓存复用导致误差积累
  • 对比之下让部分用户更认可 Qwen 系列的质量
  • Animus 微调版仓库在 HuggingFace 上被标记为含敏感内容

截至 2026-07-15

本形态显存 Q4 ~20GB / FP16 ~74GB · 国内 需代理 · 5,924 下载

快速上手

ollama run hf.co/Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF

本形态源 ↗

下载动量

观测时间线