模型 / SuperGemma4-26B (Jiunsong)

SuperGemma4-26B (Jiunsong)

Gemma4 26B 无审查 MLX, 本地代理加速

作者
Jiunsong
对位
vs 原版 Gemma 4 26B IT 量化
适合
代码与工具使用代理 / 无审查对话与指令跟随
不适合
视觉或多模态任务
入选理由
提供MLX命令行与OpenAI兼容接口,可快速部署;下载量2.5万+社区采用;基于Gemma4微调优化,benchmark提升
规模
26B (4-bit) · 最低 ~15GB · 4-bit(估算)
授权
gemma · 限制商用
框架
mlx
血统
量化自 gemma-4-26B-A4B-it
国内访问
需代理
可信度
下载 2.5 万, bench 95.8, 生成 46.2 tok/s

社区实测

SuperGemma4-26B 是 Gemma 4 26B 的社区无审查微调版,在基准分数和推理速度上均优于原版,对 Apple Silicon(MLX)和 GGUF 生态支持良好,适合本地 agent 工作流。但工具调用稳定性两极分化明显,部分用户遭遇循环卡死,且输出质量对 temperature 敏感,31B 模型在同等量化下被认为更强。

  • 去除审查拒绝,实现真正的无审查输出
  • 推理速度相比原版 Gemma 4 26B 提升约 8.7%
  • 综合基准分数从 91.4 提升至 95.8,逻辑单项从 86.9 提升至 95.2
  • 提供 MLX 4-bit 版本,可在 Apple Silicon Mac 上作为 OpenAI 兼容服务器本地运行
  • 提供 GGUF v2 版本,支持 llama.cpp、LM Studio、Jan、Open WebUI 等非 Mac 平台
  • 可与 Hermes Agent 配合用于终端优先的本地 AI 工作流
  • 可与 OpenClaw 连接作为本地推理模型用于助手和自动化任务
  • 一次性编程任务表现突出,在特定基准中得分接近 GPT 5.2 和 Gemini 3 Pro Preview
  • 韩语能力相比原版有所提升(+4.3)
  • 在 64GB Mac 上运行速度合理,不会过度占用系统资源
  • 工具调用不可靠,4-bit 变体经常漏掉工具调用并陷入参数猜测循环
  • 使用工具和自定义 harness 写代码时表现反而比一次性生成更差
  • 部分用户按模型卡推荐设置运行仍遇到模型输出异常或「坏掉」的情况
  • 编程任务需将 temperature 降至 0.3 或更低,默认高温下容易产生大量低级错误
  • 24GB 统一内存是最低舒适门槛,推荐 32GB 及以上
  • 同家族的 31B 模型在同等量化下被认为明显更强
  • 代码分析任务可能产生大量琐碎错误,有用户称之为「用过最差的模型」
  • 2B-4B 等更小尺寸版本不支持工具调用

截至 2026-06-21

本形态 ~15GB 4-bit · 国内 需代理 · 25,653 下载

仅 safetensors · 无 pickle 加载风险

快速上手

mlx_lm.server --model Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

本形态源 ↗

下载动量

30天下载 18.1k → 16.5k · likes +14

观测时间线

模型家族

查看全部家族 →