此页是 2026-06-07 的观测快照,查看该模型当前信息 → /m/mlx-community__qwen35-08b-optiq-4bit/

归档 / 2026-06-07 / Qwen3.5-0.8B-OptiQ-4bit (mlx-community)

Qwen3.5-0.8B-OptiQ-4bit (mlx-community)

苹果芯片4-bit MLX 量化 Qwen3.5-0.8B

  • Apple Silicon
  • 已量化
入选理由
为Apple Silicon优化的混合精度量化版Qwen3.5-0.8B,mlx-lm一行代码即可运行,推理性能提升但需macOS环境。
对位
对位均匀 4-bit MLX 量化
适合
Apple Silicon 本地推理 / 工具调用与代码生成
不适合
非 Apple Silicon 平台
规模
0.8B · 未知 · Q4 ~0.1GB / FP16 ~0.4GB
授权
Apache 2.0 · 可商用
框架
mlx-lm / mlx-optiq
血统
量化自 Qwen3.5-0.8B
可信度
下载 4.8k,mlx-community 出品,能力评分 +4.27 超均匀 4-bit

仅 safetensors · 无 pickle 加载风险

社区实测

Qwen3.5-0.8B-OptiQ-4bit 是 mlx-optiq 为 Apple Silicon 产出的灵敏度感知混合精度 4-bit 量化版本,在六项能力评分上全面超越统一 4-bit 量化,体积仅约 0.5 GB;社区反馈 Qwen 3.5 在 MLX 上推理速度极快,适合轻量本地任务。

  • 灵敏度感知混合精度量化:敏感层保留 8-bit,鲁棒层压缩至 4-bit,同等磁盘占用下全面超越统一 4-bit 量化
  • 体积仅约 0.5 GB,适合 Apple Silicon 设备本地部署,资源占用极低
  • 内置 MTP head,通过 optiq serve --mtp 可获得 1.4× 解码加速
  • 在六项能力评分的每一项基准上均优于统一 4-bit 量化
  • 可在 MacBook 和 iPhone 上完全离线运行,支持本地编程和视觉任务
  • Qwen 3.5 在 MLX 上推理速度极快,社区反馈 Mac Studio M3 上 4-bit 模型速度令人惊叹
  • 能力评分仅 27.0%,官方定位为玩具代理和提示词重写器,不适合复杂推理或生产级应用
  • omlx v0.2.20 升级后曾出现 Internal server error,社区工具链稳定性有待观察
  • 0.8B 参数规模天然受限,仅适合极轻量场景

截至 2026-06-21

快速上手

pip install mlx-lm; mlx_lm.generate --model mlx-community/Qwen3.5-0.8B-OptiQ-4bit --prompt '...'

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-06-07)

作者
mlx-community
任务类型
text-generation
推理库
mlx
下载
4,860
点赞
19
许可证
Apache 2.0
标签
mlx, safetensors, qwen3_5, quantized, mixed-precision, 4bit, 8bit, optiq, apple-silicon, text-generation, qwen3.5, conversational, base_model:Qwen/Qwen3.5-0.8B, base_model:quantized:Qwen/Qwen3.5-0.8B, license:apache-2.0, 4-bit, region:us

探索

源链接