此页是 2026-08-28 的观测快照,查看该模型当前信息 → /m/youssofal__qwen38-27b-mtplx-optimized-speed/

归档 / 2026-08-28 / Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal)

Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal)

Mac 上 Qwen3.8-27B 4-bit量化

  • MLX
  • 已量化
入选理由
Qwen3.8-27B 的 MLX 4-bit 量化版,保留 MTP 推测解码,在 Mac 上通过 mtplx serve 即可获得 OpenAI 兼容接口,适合本地 coding。
对位
对位 Gemma-2-27B / Qwen3-32B
适合
Mac 本地代码生成 / Apple Silicon 长上下文推理
不适合
低内存 Mac 或无损质量需求
规模
27B · 262k · Q4 ~18GB / FP16 ~65GB
授权
apache-2.0 · 需自查
框架
mlx / mtplx
血统
量化自 Qwen3.8-27B
可信度
48k 下载、103 点赞;README 报 M5 Max 58.7 tok/s

仅 safetensors · 无 pickle 加载风险

快速上手示例

mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-28)

作者
Youssofal
任务类型
text-generation
推理库
mlx
下载
48,421
点赞
103
许可证
apache-2.0
标签
mlx, safetensors, qwen3_5, apple-silicon, macos, speculative-decoding, multi-token-prediction, qwen, qwen3.8, mtp, mtplx, local-ai, coding, text-generation, conversational, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, 4-bit, region:us

探索

源链接