此页是 2026-07-31 的观测快照,查看该模型当前信息 → /m/eschalabs__qwen36-35b-a3b-escha-w2/

归档 / 2026-07-31 / Qwen3.6-35B-A3B-Escha-W2 (EschaLabs)

Qwen3.6-35B-A3B-Escha-W2 (EschaLabs)

2-bit Qwen3.6-35B-A3B,12.3GB,单卡本地推理

入选理由
Qwen3.6-35B-A3B的2-bit量化版,12.3GB单卡可运行,通过OpenAI兼容接口本地部署,保持原始模型97%+能力,适合代码生成和推理任务。
对位
对位 3B 激活参数开源模型如 Llama-3.2-3B
适合
本地私密推理 / 编程与复杂推理
不适合
多模态或视觉输入
规模
35B (3B active) · 128k · Q4 ~23GB / FP16 ~84GB
授权
Apache-2.0 · 需自查
框架
escha-runtime (SGLang) / zml
血统
量化自 Qwen3.6-35B-A3B
可信度
基准保留 FP8 100.2%,HumanEval+ 92.07,MATH-500 93.8

仅 safetensors · 无 pickle 加载风险

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   3 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-07-31)

作者
EschaLabs
任务类型
text-generation
推理库
未指定
下载
201
点赞
91
许可证
Apache-2.0
标签
safetensors, qwen3_5_moe, mixture-of-experts, moe, qwen3, 2-bit, quantization, eschamoe, sglang, zml, code, reasoning, conversational, text-generation, en, base_model:Qwen/Qwen3.6-35B-A3B, base_model:quantized:Qwen/Qwen3.6-35B-A3B, license:apache-2.0, model-index, region:us

探索

源链接