此页是 2026-07-15 的观测快照,查看该模型当前信息 → /m/prism-ml__ternary-bonsai-27b-gguf/

归档 / 2026-07-15 / Ternary-Bonsai-27B (Prism ML)

Ternary-Bonsai-27B (Prism ML)

三元权重 27B 推理模型,笔记本本地运行

入选理由
可在笔记本上以7.2GB运行27B级别模型,保留95%性能,三进制权重新范式,适合本地离线部署。
对位
对位 Qwen3.6-27B IQ2_XXS 等 2-bit 量化
适合
笔记本端侧推理 27B 模型 / 长上下文 (262K) 离线分析
不适合
手机直接部署
规模
27B · 262K · Q4 ~18GB / FP16 ~65GB
授权
Apache-2.0 · 需自查
框架
llama.cpp / mlx
血统
量化自 Qwen3.6-27B
可信度
80.49 平均分在 15 项思考基准上,保留 FP16 的 95%,部署仅 7.2GB

快速上手

ollama run hf.co/prism-ml/Ternary-Bonsai-27B-gguf

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-07-15)

作者
prism-ml
任务类型
text-generation
推理库
llama.cpp
下载
23
点赞
105
许可证
Apache-2.0
标签
llama.cpp, gguf, conversational, ternary, 2-bit, llama-cpp, cuda, metal, on-device, hybrid-attention, prismml, bonsai, text-generation, base_model:Qwen/Qwen3.6-27B, base_model:quantized:Qwen/Qwen3.6-27B, license:apache-2.0, endpoints_compatible, region:us

探索

源链接