此页是 2026-07-07 的观测快照,查看该模型当前信息 → /m/kai-os__grug-12b/
归档 / 2026-07-07 / Grug-12B (kai-os)
Grug-12B (kai-os)
紧凑推理微调,减少冗余推理轨迹,降低推理token消耗
- 入选理由
- 基于Gemma 4的紧凑推理微调,能大幅减少推理token数,适合追求推理效率的开发者,但需自行编写transformers代码,无现成API或Space试用。
- 对位
- 对位 Qwen2.5-14B, Gemma 2 9B
- 适合
- 低成本推理服务 / 数学与代码紧凑推理
- 不适合
- 需要长推导的复杂推理
- 规模
- 12B · 未知 · Q4 ~7.9GB / FP16 ~29GB
- 授权
- other · 需自查
- 框架
- transformers / vllm / ollama
- 血统
- 微调自 gemma-4-12B-it
- 可信度
- 本地36题数学代理评估:准确率100%,总生成token 2482 vs 基础模型8227
仅 safetensors · 无 pickle 加载风险
快速上手
ollama run hf.co/kai-os/Grug-12B 点击复制
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 7
HuggingFace 原始数据 (抓取于 2026-07-07)
- 作者
- kai-os
- 推理库
- transformers
- 下载
- 797
- 点赞
- 47
- 许可证
- other
- 标签
- transformers, safetensors, gemma4_unified, image-text-to-text, fine-tuned, qlora, reasoning, compact-reasoning, gemma-4, text-generation, conversational, dataset:hotdogs/uka-glm-5.2, dataset:Scale-or-Reason/general-reasoning-ift-pairs, dataset:samcheng0/lumia-reasoning-sft-v1, dataset:HSH-Intelligence/verified-math-reasoning-3k, dataset:kd13/CodeDebug-Instruct-v2-Reasoning, dataset:Madarabr/cortex-adaptive-thinking, dataset:CL-From-Nothing/code_rose_initial_1_7B_SFT_10K_rollouts_Qwen3-4B-Thinking-2507_k12_t0.7_maxtok12288, base_model:google/gemma-4-12B-it, base_model:finetune:google/gemma-4-12B-it, license:other, model-index, endpoints_compatible, region:us
探索
源链接