此页是 2026-07-14 的观测快照,查看该模型当前信息 → /m/aquaman164__qwen36-35b-a3b-mlx-vq-26bpw/
归档 / 2026-07-14 / Qwen3.6-35B-A3B-VQ (aquaman164)
Qwen3.6-35B-A3B-VQ (aquaman164)
MLX VQ量化35B MoE,适合Apple Silicon本地推理
- 入选理由
- Qwen3.6-35B-A3B的向量量化版,同尺寸下PPL优于标量量化;需在Apple Silicon上运行自定义Metal内核,提供OpenAI兼容API,适合Mac用户自部署.
- 对位
- 对位3B级密集模型
- 适合
- 本地日常对话与文本生成 / 资源受限的Apple设备推理
- 不适合
- 云端大规模部署或高精度任务
- 规模
- 35B (3B激活) · 128k · Q4 ~23GB / FP16 ~84GB
- 授权
- Apache-2.0 · 需自查
- 框架
- mlx
- 血统
- 量化自 Qwen3.6-35B-A3B
- 可信度
- 首个Apple Silicon上trained-codebook VQ模型,11.53GB,实测66 tok/s
仅 safetensors · 无 pickle 加载风险
快速上手
huggingface-cli download aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw --local-dir qwen-vq && python qwen-vq/code/vq_serve.py --model qwen-vq 点击复制
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 7
HuggingFace 原始数据 (抓取于 2026-07-14)
- 作者
- aquaman164
- 推理库
- mlx
- 下载
- 524
- 点赞
- 2
- 许可证
- Apache-2.0
- 标签
- mlx, safetensors, qwen3_5_moe, quantized, vq, aqlm, codebook, mixed-bit, moe, custom-code, text-generation, conversational, base_model:Qwen/Qwen3.6-35B-A3B, base_model:quantized:Qwen/Qwen3.6-35B-A3B, license:apache-2.0, 4-bit, region:us
探索
源链接