模型 / Gemma-4-31B-StyleTune (Gryphe)

Gemma-4-31B-StyleTune (Gryphe)

Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。

作者
Gryphe
对位
对位 Qwen2.5-32B / Command R+ 32B
适合
低陈词滥调角色扮演 / 创意写作与叙事生成
不适合
正式文书写作与代码生成
入选理由
针对Gemma 4的轻量风格微调,只改变输出层减少陈词滥调,保留原能力。适合角色扮演/创意写作用户。需自写推理代码,显存要求高。
规模
31B · 最低 ~20GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
transformers
血统
微调自 gemma-4-31B-it
国内访问
需代理
可信度
基于200个角色扮演prompt基准,陈词减少60%,共享三元组仅21.7%,作者有MythoMax等作品。

社区实测

Gemma 4 31B 是当前最具性价比的开放模型之一,在 agentic reasoning 和长周期任务上以小博大,碾压多数大得多的模型;StyleTune 在此基础上以极小的代价(仅训练 lm_head)显著改善了写作风格、减少了 60% 的陈词滥调,成为角色扮演和叙事生成场景的社区首选。但编程能力仍是明显短板,且 31B 的推理速度对本地部署有一定门槛,26B MoE 版本在速度上更友好。

  • 写作风格大幅优化:仅微调 lm_head 输出投影张量,减少 60% 陈词滥调,保留全部推理和知识能力
  • 角色扮演与叙事生成:社区反馈写作风格出色,适合需要独特语气的叙事场景
  • Agentic reasoning 以小博大:31B 在 agentic 任务上超过 Sonnet 4.6 和 Gemini 3 Pro,决策质量接近 GPT-5.2 级别
  • 长周期任务规划:在 FoodTruck Bench 上击败 GLM 5、Qwen 3.5 397B 及所有 Claude Sonnet,能听取自身建议进行多日规划
  • 文档分析能力出色:社区实测确认文档分析是其强项之一
  • 极高性价比:单次运行成本 $0.20,性能却超过 $4.43/run 的 GPT-5.2 和 $7.90/run 的 Sonnet 4.6
  • Apache 2.0 许可:完全商用自由,可在自有硬件上部署
  • 可在单 GPU 上运行:31B 密集模型可在单卡上部署,甚至有 E2B 版本可跑在手机上
  • 编程不是强项:社区明确反馈 Gemma 4 在编程方面不突出,不如同尺寸其他模型
  • 31B 推理速度有代价:有用户因速度损失更偏好 26B 版本,26B-A4B 在纯 CPU 上速度极快
  • 本地部署可能遇到问题:有实测视频记录了 31B 本地运行时的具体问题
  • 版本选择容易混淆:Google 发布了四个版本(E2B/E4B/26B/31B),选错版本会严重影响体验
  • 实际运行速度可能低于 benchmark 预期:视频指出本地速度可能比纸面数据慢
  • 社区对编程能力评价两极分化:有人称其编程接近 Sonnet,有人则认为不如此前模型

截至 2026-06-21

本形态 ~20GB 4-bit · 国内 需代理 · 278 下载

仅 safetensors · 无 pickle 加载风险

快速上手

python -c "from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained('Gryphe/Gemma-4-31B-StyleTune')"

本形态源 ↗

下载动量

30天下载 2.4k → 2.4k · likes +18

观测时间线

模型家族

查看全部家族 →