此页是 2026-05-18 的观测快照,查看该模型当前信息 → /m/hauhaucs__gemma4-26b-a4b-uncensored-hauhaucs-balanced/

归档 / 2026-05-18 / Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)

Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)

Gemma4 无审查多模态 MoE,面向创意写作与角色扮演

入选理由
GGUF格式可直接运行;本质是微调去审查非新能力。
对位
对位 Google Gemma-4-26B-it,去除安全审查
适合
创意写作与角色扮演 / 多模态图片-文本对话
不适合
高复杂度 agentic 编程任务
规模
26B (25.2B total, 3.8B active) · 256K
授权
Apache-2.0 · 可商用
框架
llama.cpp / LM Studio / koboldcpp
血统
量化自 gemma-4-26B-A4B-it
可信度
HuggingFace 40k+ 下载,0/465 拒答测试结果,基于 google/gemma-4-26B-A4B-it

社区实测

Gemma 4 26B 在单轮编程中表现惊艳、接近 GPT-5.2 水平,HauhauCS 的 Balanced 去审查版在常规使用中几乎零拒答,且文件体积小、消费级硬件可跑,是性价比很高的本地模型;但在编程/Agent 多轮任务上明显落后于同期的 Qwen3.6-35B-A3B,且创作者社区沟通风格存在争议。

  • 常规使用中几乎零拒答,仅极端边缘提示首次可能回避、重新提问后通过
  • 文件体积紧凑(Q6 仅 23.3GB),在同级 MoE 模型中显存门槛更低
  • 可在 16GB 有限显存环境下运行
  • 消费级硬件推理速度尚可(M4 Pro 48GB 上约 73.2 tok/s)
  • 可在 2×T4(共 32GB)上以约 40 tok/s 运行
  • 支持 llama.cpp、vLLM、Unsloth Studio、Docker Model Runner 等多种推理后端
  • 单轮编程能力强,在特定基准上接近 GPT-5.2 和 Gemini 3 Pro Preview 水平
  • 能产出可工作的代码,约 4 轮迭代修复 bug
  • 提供 Q4_K_P 量化版本,便于本地高效部署
  • 输出完整、不截断,适合角色扮演等创作场景
  • 极端边缘提示首次仍可能回避(需重新提问才通过)
  • 编程/Agent 多轮任务显著落后于 Qwen3.6-35B-A3B(Terminal-Bench 2.0 差距约 8.6 分)
  • 使用工具/自定义 harness 进行代码评估时表现反而比单轮更差
  • 创作者 HauhauCS 被社区批评拒绝与不同意见者对话、存在抄袭争议
  • 模型卡显示全面提升但实际使用体验好坏参半
  • 同硬件上推理速度慢于 Qwen3.6-35B-A3B(73.2 vs 81.6 tok/s)

截至 2026-06-21

快速上手

llama-server -m Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-Q4_K_P.gguf --mmproj mmproj-Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-f16.gguf --jinja -c 32768 -ngl 99

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-05-18)

作者
HauhauCS
任务类型
image-text-to-text
推理库
未指定
下载
40,301
点赞
53
许可证
Apache-2.0
标签
gguf, uncensored, gemma4, moe, vision, multimodal, agentic, coding, image-text-to-text, en, base_model:google/gemma-4-26B-A4B-it, base_model:quantized:google/gemma-4-26B-A4B-it, license:apache-2.0, endpoints_compatible, region:us, imatrix, conversational

探索

源链接