gemma-4-12B-it (Google)
Google Gemma 4 12B 指令模型,GGUF 量化版本
社区实测
社区普遍认可其无编码器多模态架构设计简洁,但实测中 26B-A4B MoE 变体在各项场景均优于 12B 且速度更快,编码能力则明显偏弱。
- 无编码器架构降低了音视觉输入处理的延迟与内存占用
- Q4 量化后仅需约 9 GB 显存即可运行
- 综合表现优于全精度 9B 级别模型
- 同家族 26B-A4B 变体在各场景均胜出且推理速度快约 1.7 倍
- 未针对编码任务训练,编码能力弱
- 社区建议编码场景搭配 Qwen 等模型做混合方案
来源
New Google Gemma 4 12B Claims Near-26B Performance - Reddita unified, encoder-free multimodal model : r/LocalLLMGemma 4 12B: A unified, encoder-free multimodal model
截至 2026-06-19
快速上手
ollama: ollama run hf.co/lmstudio-community/gemma-4-12B-it-GGUF:Q4_K_M