North-Mini-Code-1.0 (CohereLabs)
30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务
仅 safetensors · 无 pickle 加载风险
社区实测
编码质量在同量级模型中表现不错,但长上下文下首 token 延迟(prefill)是实际使用的最大痛点
- 30B 总参/3B 激活的 MoE 架构可运行在 32GB 消费级笔记本上
- 在 Artificial Analysis 编码指数(33.4)上超过部分参数量更大的模型,同量级中编码能力有竞争力
- 22K token 上下文下首 token 延迟约 115 秒,长上下文下实际可用性差
- 综合 benchmark 得分(28)明显弱于 Qwen 3.6 35B(43),非编码任务表现一般
来源
Cohere North Mini Code 1.0 : r/LocalLLaMAI Ran Cohere's North Mini Code on a 32GB M1 Pro. Quality Isn't the Problem — Prefill Is.Cohere released North Mini Code: It's first Open-Source Agentic ...
截至 2026-07-19
本形态 ~18GB 4-bit · 国内 需代理 · 1,784 下载
仅 safetensors · 无 pickle 加载风险
快速上手
vllm serve CohereLabs/North-Mini-Code-1.0 本形态 ~18GB 4-bit · 国内 需代理 · 11,376 下载
快速上手
llama-server -hf unsloth/North-Mini-Code-1.0-GGUF --model North-Mini-Code-1.0-UD-Q4_K_XL.gguf --jinja --n-gpu-layers 99 --ctx-size 16384 (需llama.cpp PR #24260) 下载动量
30天下载 28k → 22.7k · likes +49