此页是 2026-07-18 的观测快照,查看该模型当前信息 → /m/andreaborio__qwen36-35b-a3b-ds4-expertmajor-v1-gguf/
归档 / 2026-07-18 / Qwen3.6-35B-A3B (andreaborio)
Qwen3.6-35B-A3B (andreaborio)
Qwen3.6 MoE 量化版,Apple Metal 加速推理
- 入选理由
- Qwen3.6-35B-A3B的GGUF量化版,含标准格式可直接用llama.cpp,苹果用户可试用作者优化版。仅量化重打包,无新能力。
- 对位
- 对位 Qwen2.5-3B (3B 激活)
- 适合
- Apple Silicon 本地聊天 / 低内存 MoE 研究
- 不适合
- 非 Apple Metal 平台
- 规模
- 35B (3B 激活) · 未知 · Q4 ~23GB / FP16 ~84GB
- 授权
- apache-2.0 · 需自查
- 框架
- llama.cpp / ollama / MLX / DS4
- 血统
- 量化自 Qwen3.6-35B-A3B
- 可信度
- 基于 Qwen 官方 Apache 2.0;Unsloth 量化;M5 Pro 实测 57.81 t/s
快速上手
ollama run hf.co/andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF 点击复制
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 1 / 5
- 总分
- 7
HuggingFace 原始数据 (抓取于 2026-07-18)
- 作者
- andreaborio
- 推理库
- 未指定
- 下载
- 102
- 点赞
- 0
- 许可证
- apache-2.0
- 标签
- gguf, ds4, qwen3.6, qwen35moe, apple-silicon, metal, quantized, experimental, expert-major, text-generation, base_model:Qwen/Qwen3.6-35B-A3B, base_model:quantized:Qwen/Qwen3.6-35B-A3B, license:apache-2.0, region:us, imatrix, conversational
探索
源链接