此页是 2026-08-28 的观测快照,查看该模型当前信息 → /m/youssofal__qwen38-27b-mtplx-optimized-speed/
归档 / 2026-08-28 / Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal)
Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal)
Mac 上 Qwen3.8-27B 4-bit量化
- 入选理由
- Qwen3.8-27B 的 MLX 4-bit 量化版,保留 MTP 推测解码,在 Mac 上通过 mtplx serve 即可获得 OpenAI 兼容接口,适合本地 coding。
- 对位
- 对位 Gemma-2-27B / Qwen3-32B
- 适合
- Mac 本地代码生成 / Apple Silicon 长上下文推理
- 不适合
- 低内存 Mac 或无损质量需求
- 规模
- 27B · 262k · Q4 ~18GB / FP16 ~65GB
- 授权
- apache-2.0 · 需自查
- 框架
- mlx / mtplx
- 血统
- 量化自 Qwen3.8-27B
- 可信度
- 48k 下载、103 点赞;README 报 M5 Max 58.7 tok/s
仅 safetensors · 无 pickle 加载风险
快速上手示例
mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 3 / 5
- Q3
- 是新东西吗 1 / 5
- 总分
- 9
HuggingFace 原始数据 (抓取于 2026-08-28)
- 作者
- Youssofal
- 推理库
- mlx
- 下载
- 48,421
- 点赞
- 103
- 许可证
- apache-2.0
- 标签
- mlx, safetensors, qwen3_5, apple-silicon, macos, speculative-decoding, multi-token-prediction, qwen, qwen3.8, mtp, mtplx, local-ai, coding, text-generation, conversational, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, 4-bit, region:us
探索
源链接