模型 / gemma-4-A4B-98e-v6-coder (ManniX-ITA)

gemma-4-A4B-98e-v6-coder (ManniX-ITA)

Gemma 4 98e coder GGUF量化,本地代码生成与推理

作者 ManniX-ITA

仓库标识ManniX-ITA/gemma-4-A4B-98e-v6-coder-it-GGUF

~12GB 4-bit许可 限制商用最近核对 2026-07-31
格式
4-bit
文件
~11GB
运行内存
~12GB–16GB
运行时
OLLAMA
下载
8,500

Hugging Face 源仓库 ↗

快速上手示例

ollama run mannix/gemma4-98e-v6-coder

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
专为代码任务优化的Gemma 4剪枝版,GGUF格式可直接用llama.cpp或ollama运行,代码生成与推理能力显著提升,适合开发者本地部署。
对位
对比 Qwen2.5-Coder-14B (14.7B dense)
适合
本地代码生成与补全 / 高难度算法题与 LiveCodeBench
不适合
通用对话或非代码推理

完整规格

规模
20.8B (4B active MoE) · 32k · 下载 ~11GB · 显存最低 ~12GB · 推荐 ~16GB · 4-bit(估算)
授权
Gemma · 限制商用
框架
llama.cpp / ollama / vllm
血统
量化自 gemma-4-A4B-98e-v6-coder-it
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 11.2k → 1.1k

观测时间线