模型 / Qwen3.8-27B-Escha-W2 (Escha)

Qwen3.8-27B-Escha-W2 (Escha)

2-bit 量化 27B 模型,24GB 显卡 64k 上下文

作者 EschaLabs

仓库标识EschaLabs/Qwen3.8-27B-Escha-W2

~9.2GB 2-bit许可 可商用任务 文本生成最近核对 2026-08-24
格式
2-bit
文件
~8GB
运行内存
~9.2GB–12GB
运行时
SGLang (escha_runtime)
下载
1,892

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
2-bit 量化将 27B 模型压缩至 10.15GB,单卡 24GB 可跑 64k 上下文,提供 OpenAI 兼容接口。需自装专用 SGLang 运行时,适合显存有限但需要高密度部署的用户。
对位
对位 Qwen3.8-27B 原版 (FP8)
适合
消费级显卡 (24GB) 运行 27B 模型 / 代码生成、推理、对话
不适合
多模态 (视觉) 任务

完整规格

规模
27B · 128k · 下载 ~8GB · 显存最低 ~9.2GB · 推荐 ~12GB · 2-bit(估算)
授权
Apache-2.0 · 可商用
框架
SGLang (escha_runtime)
血统
量化自 Qwen3.8-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2.8k → 3.9k

观测时间线

模型家族

查看全部家族 →