此页是 2026-07-31 的观测快照,查看该模型当前信息 → /m/eschalabs__qwen36-35b-a3b-escha-w2/
归档 / 2026-07-31 / Qwen3.6-35B-A3B-Escha-W2 (EschaLabs)
Qwen3.6-35B-A3B-Escha-W2 (EschaLabs)
2-bit Qwen3.6-35B-A3B,12.3GB,单卡本地推理
- 入选理由
- Qwen3.6-35B-A3B的2-bit量化版,12.3GB单卡可运行,通过OpenAI兼容接口本地部署,保持原始模型97%+能力,适合代码生成和推理任务。
- 对位
- 对位 3B 激活参数开源模型如 Llama-3.2-3B
- 适合
- 本地私密推理 / 编程与复杂推理
- 不适合
- 多模态或视觉输入
- 规模
- 35B (3B active) · 128k · Q4 ~23GB / FP16 ~84GB
- 授权
- Apache-2.0 · 需自查
- 框架
- escha-runtime (SGLang) / zml
- 血统
- 量化自 Qwen3.6-35B-A3B
- 可信度
- 基准保留 FP8 100.2%,HumanEval+ 92.07,MATH-500 93.8
仅 safetensors · 无 pickle 加载风险
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 3 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 11
HuggingFace 原始数据 (抓取于 2026-07-31)
- 作者
- EschaLabs
- 推理库
- 未指定
- 下载
- 201
- 点赞
- 91
- 许可证
- Apache-2.0
- 标签
- safetensors, qwen3_5_moe, mixture-of-experts, moe, qwen3, 2-bit, quantization, eschamoe, sglang, zml, code, reasoning, conversational, text-generation, en, base_model:Qwen/Qwen3.6-35B-A3B, base_model:quantized:Qwen/Qwen3.6-35B-A3B, license:apache-2.0, model-index, region:us
探索
源链接