SummFlow 2026-06-23 Hugging Face

Huihui-gemma-4-12B-coder-abliterated (huihui-ai)

未审查版 Gemma 代码模型,用于编程与推理,已去除拒答

入选理由
Gemma-4-12B 的去审查版,适合研究无安全过滤的代码/推理场景,需自行编写 transformers 推理代码。
对位
对位 Gemma-4-12B-Coder 原版
适合
编程与代码推理(无拒答) / 研究安全对齐移除效果
不适合
生产环境、需内容审核的场景
规模
12B · 未知 · Q4 ~7.9GB / FP16 ~29GB
授权
apache-2.0 · 需自查
框架
transformers
血统
微调自 gemma-4-12B-coder-fable5-composer2.5-v1
可信度
HuggingFace 下载量 1773, 点赞 91, 基于 abliteration 移除安全对齐

仅 safetensors · 无 pickle 加载风险

社区实测

这是 Gemma 4 12B 编码微调版的 abliteration(去审查)变体,可通过 Ollama 一键部署,INT4 量化后仅需约 6.5GB 显存即可在消费级 GPU 上运行,支持 Claude Code、OpenCode 等多种编程代理框架;但 abliteration 被描述为「粗糙的概念验证实现」,有用户反馈 huihui 的去审查模型「失去的比得到的多」。

  • 去除模型拒绝回答的限制,实现无审查输出
  • INT4 量化后仅需约 6.5GB 显存,可在 RTX 4090 等消费级 GPU 上运行
  • 通过 Ollama 一行命令即可部署
  • 支持 128K 上下文窗口
  • 支持文本和图像多模态输入
  • 内置支持 Claude Code、OpenCode、Codex 等多种编程代理工具
  • Apache 2.0 开源许可
  • abliteration 被描述为「粗糙的概念验证实现」,并非成熟方案
  • 有社区用户反馈 huihui 的去审查模型整体上「失去的比得到的多」
  • Gemma 4 12B 缺乏专用视觉编码器,视觉理解能力受限
  • 模型卡片明确声明不适合生产环境或面向公众的应用
  • 内容过滤极其有限,可能生成不适宜的输出
  • FP16 全精度推理需约 26GB 显存,多数消费级 GPU 无法承载
  • 使用者需自行承担法律和伦理风险

截至 2026-06-28

快速上手

vllm serve huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated