此页是 2026-07-18 的观测快照,查看该模型当前信息 → /m/andreaborio__qwen36-35b-a3b-ds4-expertmajor-v1-gguf/

归档 / 2026-07-18 / Qwen3.6-35B-A3B (andreaborio)

Qwen3.6-35B-A3B (andreaborio)

Qwen3.6 MoE 量化版,Apple Metal 加速推理

入选理由
Qwen3.6-35B-A3B的GGUF量化版,含标准格式可直接用llama.cpp,苹果用户可试用作者优化版。仅量化重打包,无新能力。
对位
对位 Qwen2.5-3B (3B 激活)
适合
Apple Silicon 本地聊天 / 低内存 MoE 研究
不适合
非 Apple Metal 平台
规模
35B (3B 激活) · 未知 · Q4 ~23GB / FP16 ~84GB
授权
apache-2.0 · 需自查
框架
llama.cpp / ollama / MLX / DS4
血统
量化自 Qwen3.6-35B-A3B
可信度
基于 Qwen 官方 Apache 2.0;Unsloth 量化;M5 Pro 实测 57.81 t/s

快速上手

ollama run hf.co/andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   1 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-07-18)

作者
andreaborio
任务类型
text-generation
推理库
未指定
下载
102
点赞
0
许可证
apache-2.0
标签
gguf, ds4, qwen3.6, qwen35moe, apple-silicon, metal, quantized, experimental, expert-major, text-generation, base_model:Qwen/Qwen3.6-35B-A3B, base_model:quantized:Qwen/Qwen3.6-35B-A3B, license:apache-2.0, region:us, imatrix, conversational

探索

源链接