此页是 2026-07-15 的观测快照,查看该模型当前信息 → /m/prism-ml__bonsai-27b-gguf/

归档 / 2026-07-15 / Bonsai-27B (Prism ML)

Bonsai-27B (Prism ML)

27B 1-bit 量化模型,面向笔记本与手机本地推理

入选理由
基于 Qwen3.6-27B 的 1-bit 量化,仅 3.9GB 即可运行 27B 推理,保留 89.5% 性能,适合笔记本和单卡,直接下载 GGUF 运行。
对位
对位 Qwen3.6-27B 及 Gemma-4-31B 的量化版
适合
本地隐私推理,笔记本/手机可用 / 262K 上下文,数学与编程任务
不适合
长期 agent 编码与多文件重构
规模
27B · 262K · Q4 ~18GB / FP16 ~65GB
授权
Apache 2.0 · 需自查
框架
llama.cpp
血统
量化自 Qwen3.6-27B
可信度
提供 whitepaper 与 llama.cpp 专用内核,15项 thinking 基准可复现

快速上手

ollama run hf.co/prism-ml/Bonsai-27B-gguf

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-07-15)

作者
prism-ml
任务类型
text-generation
推理库
llama.cpp
下载
513
点赞
62
许可证
Apache 2.0
标签
llama.cpp, gguf, conversational, 1-bit, llama-cpp, cuda, metal, on-device, hybrid-attention, prismml, bonsai, text-generation, base_model:Qwen/Qwen3.6-27B, base_model:quantized:Qwen/Qwen3.6-27B, license:apache-2.0, endpoints_compatible, region:us

探索

源链接