SummFlow 2026-07-16 Hugging Face

Bonsai-27B-mlx-1bit (Prism ML)

1-bit 27B 模型, 可在手机和笔记本本地运行推理

  • Apple Silicon
入选理由
首个手机可运行的27B推理模型,1-bit量化保留90%性能,适合隐私离线场景,需Apple Silicon或CUDA。
对位
对位 Qwen3.6-27B 及 Gemma-4-31B 的低比特量化版
适合
手机端本地27B推理 / 262K长上下文处理
不适合
复杂智能体编程任务
规模
27B · 262K · Q4 ~18GB / FP16 ~65GB
授权
apache-2.0 · 需自查
框架
mlx / llama.cpp / mlx-swift
血统
量化自 Qwen3.6-27B
可信度
公布15项思维模式基准平均76.11分,保留FP16的89.5%,含详细部署说明

仅 safetensors · 无 pickle 加载风险

快速上手

mlx_lm.generate --model prism-ml/Bonsai-27B-mlx-1bit