此页是 2026-07-15 的观测快照,查看该模型当前信息 → /m/prism-ml__ternary-bonsai-27b-gguf/
归档 / 2026-07-15 / Ternary-Bonsai-27B (Prism ML)
Ternary-Bonsai-27B (Prism ML)
- 入选理由
- 可在笔记本上以7.2GB运行27B级别模型,保留95%性能,三进制权重新范式,适合本地离线部署。
- 对位
- 对位 Qwen3.6-27B IQ2_XXS 等 2-bit 量化
- 适合
- 笔记本端侧推理 27B 模型 / 长上下文 (262K) 离线分析
- 不适合
- 手机直接部署
- 规模
- 27B · 262K · Q4 ~18GB / FP16 ~65GB
- 授权
- Apache-2.0 · 需自查
- 框架
- llama.cpp / mlx
- 血统
- 量化自 Qwen3.6-27B
- 可信度
- 80.49 平均分在 15 项思考基准上,保留 FP16 的 95%,部署仅 7.2GB
快速上手
ollama run hf.co/prism-ml/Ternary-Bonsai-27B-gguf 点击复制
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 5 / 5
- 总分
- 11
HuggingFace 原始数据 (抓取于 2026-07-15)
- 作者
- prism-ml
- 推理库
- llama.cpp
- 下载
- 23
- 点赞
- 105
- 许可证
- Apache-2.0
- 标签
- llama.cpp, gguf, conversational, ternary, 2-bit, llama-cpp, cuda, metal, on-device, hybrid-attention, prismml, bonsai, text-generation, base_model:Qwen/Qwen3.6-27B, base_model:quantized:Qwen/Qwen3.6-27B, license:apache-2.0, endpoints_compatible, region:us
探索
源链接