此页是 2026-08-24 的观测快照,查看该模型当前信息 → /m/eschalabs__qwen38-27b-escha-w2/

归档 / 2026-08-24 / Qwen3.8-27B-Escha-W2 (Escha)

Qwen3.8-27B-Escha-W2 (Escha)

2-bit 量化 27B 模型,24GB 显卡 64k 上下文

入选理由
2-bit 量化将 27B 模型压缩至 10.15GB,单卡 24GB 可跑 64k 上下文,提供 OpenAI 兼容接口。需自装专用 SGLang 运行时,适合显存有限但需要高密度部署的用户。
对位
对位 Qwen3.8-27B 原版 (FP8)
适合
消费级显卡 (24GB) 运行 27B 模型 / 代码生成、推理、对话
不适合
多模态 (视觉) 任务
规模
27B · 128k · Q4 ~18GB / FP16 ~65GB
授权
Apache-2.0 · 需自查
框架
SGLang (escha_runtime)
血统
量化自 Qwen3.8-27B
可信度
1892 下载,120 赞,与 FP8 参考模型 GPQA 分数仅差 1 题

仅 safetensors · 无 pickle 加载风险

评分详情

Q1
今天能接上用吗   4 / 5
Q2
有可信证据吗   2 / 5
Q3
是新东西吗   4 / 5
总分
10

HuggingFace 原始数据 (抓取于 2026-08-24)

作者
EschaLabs
任务类型
text-generation
推理库
未指定
下载
1,892
点赞
120
许可证
Apache-2.0
标签
safetensors, qwen3_5, qwen3, 2-bit, quantization, escha, sglang, code, reasoning, conversational, text-generation, en, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, model-index, region:us

探索

源链接