SummFlow 2026-07-15 Hugging Face

Bonsai-27B (Prism ML)

27B 1-bit 量化模型,面向笔记本与手机本地推理

入选理由
基于 Qwen3.6-27B 的 1-bit 量化,仅 3.9GB 即可运行 27B 推理,保留 89.5% 性能,适合笔记本和单卡,直接下载 GGUF 运行。
对位
对位 Qwen3.6-27B 及 Gemma-4-31B 的量化版
适合
本地隐私推理,笔记本/手机可用 / 262K 上下文,数学与编程任务
不适合
长期 agent 编码与多文件重构
规模
27B · 262K · Q4 ~18GB / FP16 ~65GB
授权
Apache 2.0 · 需自查
框架
llama.cpp
血统
量化自 Qwen3.6-27B
可信度
提供 whitepaper 与 llama.cpp 专用内核,15项 thinking 基准可复现

快速上手

ollama run hf.co/prism-ml/Bonsai-27B-gguf