Gemma4-12B-Coder (yuxinlu1)
本地 Python 编程模型,离线解决算法问题
社区实测
社区评价两极分化:部分用户认为 Gemma 4 12B 在 12B 级别本地编程表现亮眼,Q5 量化下可一键完成不少编码任务且部署即插即用;但另一些用户指出其在 OpenCode 等工具调用场景下几乎不可用,严肃编程仍倾向更大的模型。
- 完全离线在笔记本上运行高阶推理(evidence 0)
- Pi harness 下即插即用,设置缓存和上下文长度后即可开始编程(evidence 3)
- Q5_K_XL 量化下多数编码任务可一次通过(one-shotted),Q4 下速度约 61 t/s(evidence 3)
- 可连续生成 4372 token、467 行代码的完整游戏,单次流式输出约 4 分钟(evidence 6)
- 适合 Lua 脚本编写(如 Cyberpunk 2077 mod)(evidence 3)
- 原生多模态:文本、图像、音频、视频(evidence 11)
- Apache 2.0 完全宽松许可(evidence 11)
- 部署方式丰富:llama.cpp、Ollama、Pi、Unsloth Studio、Hermes Agent 等(evidence 9)
- 体积小,可在消费级硬件上运行(evidence 12)
- OpenCode 下工具调用极差,Q8 量化连一次工具调用都无法完成,只回复"Okay."(evidence 4、7)
- 工具调用时反复无法正确指定参数(如 grep 的 pattern),调用被拒绝(evidence 7)
- 有用户明确表示不会用它做编程调试,倾向 Gemma-4-31B 或 Qwen3.6-27B(evidence 1)
- 该 Fable-5 微调被质疑为噱头,认为 12B 模型无法承载更大模型的推理能力(evidence 2)
- 官方 8Q 模型存在拒答问题,需 heretic 版本才能正常生成(evidence 6)
- Q8 量化生成速度骤降至 25.2 t/s,相比 Q4 的 72.3 t/s 大幅下降(evidence 5)
- 尚无 assistant 模型的 GGUF 量化版本(evidence 5)
- MTP(多 token 预测)支持仍在开发中(evidence 5)
Gemma 4 12B Coder-Fable-5 reasoning dropped and it's running ...Is Gemma 4 12b good for coding? : r/LocalLLaMA - RedditWhat the hell is this? gemma-4-12B-coder-fable5- ...Gemma 4 12B is my new main squeeze : r/LocalLLaMA - RedditGemma 4 12B first coding agent test on a 4080 Super - RedditGemma 4 12B: A unified, encoder-free multimodal modelGemma 4 12b 8Q Heretic Oneshot Coding : r/LocalLLaMAGemma 4 12B: incompatible with opencode, or just awful at tool ...yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF · Hugging FaceGemma 4 12B: Specs, Benchmarks & How to Run It LocallyGemma4-12B-Coder GGUF Fable 5 Composer 2.5 : Local Coding ...
截至 2026-06-21
快速上手
ollama run hf.co/yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF