模型 / Qwen3.6-35B-A3B-VQ-3.4bpw (TheDrainFlorist)

Qwen3.6-35B-A3B-VQ-3.4bpw (TheDrainFlorist)

Apple 芯片 13.8GiB VQ 量化,24GB 可跑

作者 TheDrainFlorist

仓库标识TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw

显存未知许可 可商用任务 文本生成最近核对 2026-09-10
运行内存
格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
运行时
PYTHON
下载
1,407

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw --prompt 'Explain the difference between a mutex and a semaphore.' --max-tokens 512

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
13.8GB 的 Qwen3.6 量化版,Apple Silicon 上可直接跑,速度约 66 tok/s,比同尺寸 4-bit 量化质量更好,适合 24GB 内存 Mac 本地部署。
对位
对位 Qwen3-30B-A3B / Llama-3.2-3B
适合
Apple Silicon 本机运行与推理 / 较 4-bit 更小体积的量化部署
不适合
追求最低 perplexity 或最高质量

完整规格

规模
35B-A3B · 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
授权
apache-2.0 · 可商用
框架
mlx-lm / mlx_vlm
血统
量化自 Qwen3.6-35B-A3B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.4k → 1.8k

观测时间线

模型家族

查看全部家族 →