SummFlow 2026-07-18 Hugging Face

Qwen3.6-35B-A3B (andreaborio)

Qwen3.6 MoE 量化版,Apple Metal 加速推理

入选理由
Qwen3.6-35B-A3B的GGUF量化版,含标准格式可直接用llama.cpp,苹果用户可试用作者优化版。仅量化重打包,无新能力。
对位
对位 Qwen2.5-3B (3B 激活)
适合
Apple Silicon 本地聊天 / 低内存 MoE 研究
不适合
非 Apple Metal 平台
规模
35B (3B 激活) · 未知 · Q4 ~23GB / FP16 ~84GB
授权
apache-2.0 · 需自查
框架
llama.cpp / ollama / MLX / DS4
血统
量化自 Qwen3.6-35B-A3B
可信度
基于 Qwen 官方 Apache 2.0;Unsloth 量化;M5 Pro 实测 57.81 t/s

快速上手

ollama run hf.co/andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF