Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)
Gemma4 无审查多模态 MoE,面向创意写作与角色扮演
社区实测
Gemma 4 26B 在单轮编程中表现惊艳、接近 GPT-5.2 水平,HauhauCS 的 Balanced 去审查版在常规使用中几乎零拒答,且文件体积小、消费级硬件可跑,是性价比很高的本地模型;但在编程/Agent 多轮任务上明显落后于同期的 Qwen3.6-35B-A3B,且创作者社区沟通风格存在争议。
- 常规使用中几乎零拒答,仅极端边缘提示首次可能回避、重新提问后通过
- 文件体积紧凑(Q6 仅 23.3GB),在同级 MoE 模型中显存门槛更低
- 可在 16GB 有限显存环境下运行
- 消费级硬件推理速度尚可(M4 Pro 48GB 上约 73.2 tok/s)
- 可在 2×T4(共 32GB)上以约 40 tok/s 运行
- 支持 llama.cpp、vLLM、Unsloth Studio、Docker Model Runner 等多种推理后端
- 单轮编程能力强,在特定基准上接近 GPT-5.2 和 Gemini 3 Pro Preview 水平
- 能产出可工作的代码,约 4 轮迭代修复 bug
- 提供 Q4_K_P 量化版本,便于本地高效部署
- 输出完整、不截断,适合角色扮演等创作场景
- 极端边缘提示首次仍可能回避(需重新提问才通过)
- 编程/Agent 多轮任务显著落后于 Qwen3.6-35B-A3B(Terminal-Bench 2.0 差距约 8.6 分)
- 使用工具/自定义 harness 进行代码评估时表现反而比单轮更差
- 创作者 HauhauCS 被社区批评拒绝与不同意见者对话、存在抄袭争议
- 模型卡显示全面提升但实际使用体验好坏参半
- 同硬件上推理速度慢于 Qwen3.6-35B-A3B(73.2 vs 81.6 tok/s)
来源
Gemma4-26B-A4B Uncensored Balanced is out with K_P quants! : r/LocalLLaMAGemma 26b a4b Uncensored HauHauCS-BalancedI ran Gemma 4 as a local model in Codex CLI - Hacker NewsGemma 4 26B really is an outlier in its weight class. In our little known, diffi... | Hacker NewsHauhauCS/Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced · Hugging FaceI Tested Alibaba Qwen3.6–35B-A3B vs Google Gemma 4 26B A4B ...Can I really code on my PC? Gemma4 26B A4B vs Qwen3.6 ...
截至 2026-06-21
快速上手
llama-server -m Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-Q4_K_P.gguf --mmproj mmproj-Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-f16.gguf --jinja -c 32768 -ngl 99