此页是 2026-07-31 的观测快照,查看该模型当前信息 → /m/mannix-ita__gemma-4-a4b-98e-v6-coder-it-gguf/

归档 / 2026-07-31 / gemma-4-A4B-98e-v6-coder (ManniX-ITA)

gemma-4-A4B-98e-v6-coder (ManniX-ITA)

Gemma 4 98e coder GGUF量化,本地代码生成与推理

入选理由
专为代码任务优化的Gemma 4剪枝版,GGUF格式可直接用llama.cpp或ollama运行,代码生成与推理能力显著提升,适合开发者本地部署。
对位
对比 Qwen2.5-Coder-14B (14.7B dense)
适合
本地代码生成与补全 / 高难度算法题与 LiveCodeBench
不适合
通用对话或非代码推理
规模
20.8B (4B active MoE) · 32k · Q4 ~14GB / FP16 ~50GB
授权
Gemma · 需自查
框架
llama.cpp / ollama / vllm
血统
量化自 gemma-4-A4B-98e-v6-coder-it
可信度
HuggingFace 8500+ 下载;HumanEval+ 93.29%,imatrix 量化

快速上手示例

ollama run mannix/gemma4-98e-v6-coder

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   3 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-07-31)

作者
ManniX-ITA
任务类型
unknown
推理库
未指定
下载
8,500
点赞
4
许可证
Gemma
标签
gguf, imatrix, quantized, gemma4, moe, code, arxiv:2409.12186, arxiv:2406.11931, arxiv:2405.04324, arxiv:2412.08905, base_model:ManniX-ITA/gemma-4-A4B-98e-v6-coder-it, base_model:quantized:ManniX-ITA/gemma-4-A4B-98e-v6-coder-it, license:gemma, endpoints_compatible, region:us, conversational

探索

源链接