模型 / Gemma-4-31B-StyleTune (Gryphe)

Gemma-4-31B-StyleTune (Gryphe)

Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。

作者 Gryphe

仓库标识Gryphe/Gemma-4-31B-StyleTune

显存未知许可 可商用任务 文本生成最近核对 2026-08-16
运行内存
权重格式未知,无法估算显存
运行时
transformers
下载
278

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
针对Gemma 4的轻量风格微调,只改变输出层减少陈词滥调,保留原能力。适合角色扮演/创意写作用户。需自写推理代码,显存要求高。
对位
对位 Qwen2.5-32B / Command R+ 32B
适合
低陈词滥调角色扮演 / 创意写作与叙事生成
不适合
正式文书写作与代码生成

独立证据与社区反馈

12 个独立来源最近验证 2026-08-16

Gemma 4 31B 被社区广泛认可为当前本地部署的最佳基线模型,在 Arena AI 开放模型排行榜上名列第三,性价比突出。日常编码辅助和写作任务表现可靠,但深度推理仍不及前沿闭源模型,工具调用和指令遵循是明显短板。

  • 写作场景下指令遵循优于 Qwen 122B 量化版
  • 在本地编码辅助和日常任务中表现可靠
  • 摘要任务中持续优于 GLM 5.0/5.1,高上下文召回更好
  • 相比竞品正向偏差更少,输出更客观
  • 在逻辑陷阱题上正确作答,推理一致性优于部分同系小模型
  • 31B Dense 在 Arena AI 开放模型榜单排名第三,26B MoE 排第六
  • 在数学、编程、工具使用基准上匹敌或超越 Llama 4 和 Qwen 3.5
  • Apache 2.0 许可证消除商业使用障碍
  • 编码基准分数高于 Qwen 3.5 27B
  • MTP drafter 性能出色
  • 可在 M5 Max 128GB 内存的设备上本地运行
  • 工具调用和指令遵循能力极弱,忽略指令的情况比竞品更多
  • 在深度推理方面仍无法触及前沿闭源模型
  • 31B Dense 需全部加载,24GB 显存的 RTX 4090 成为瓶颈,需借助系统内存卸载
  • 对硬件配置敏感,部分用户报告模型表现偏执且不适合其硬件
  • 在带宽受限条件下,26B MoE 的解码吞吐量显著高于 31B Dense

可信度基于200个角色扮演prompt基准,陈词减少60%,共享三元组仅21.7%,作者有MythoMax等作品。

完整规格

规模
31B · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
transformers
血统
微调自 gemma-4-31B-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2k → 1.9k · likes +4

观测时间线

模型家族

查看全部家族 →