模型 / Qwen3.8-Whittle-MoE-27B-A17.8B (logic65)

Qwen3.8-Whittle-MoE-27B-A17.8B (logic65)

从 Qwen3.8-27B 切割的 MoE,24GB 本地对话/代码

作者 logic65

仓库标识logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

~16GB 4-bit许可 可商用最近核对 2026-08-27
格式
4-bit
文件
~14GB
运行内存
~16GB–21GB
运行时
LLAMA-SERVER
下载
13,849

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf logic65/Qwen3.8-Whittle-MoE-27B-A17.8B -ngl 99 -c 8192 --jinja

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
从 Qwen3.8-27B 切出的 MoE,激活参数约 18B,提供 GGUF 可本地运行,24GB 显存即可,已修复循环问题,适合低显存部署。
对位
对位 Mixtral-8x7B / Qwen3-14B
适合
本地 24GB 量化的对话与代码生成 / 复现 router healing 与 MoE 压缩研究
不适合
SQL/HTML/表格结构化输出

完整规格

规模
27B (17.8B active) · 8k · 下载 ~14GB · 显存最低 ~16GB · 推荐 ~21GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
llama.cpp
血统
量化自 Qwen3.8-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 14.7k → 27.7k

观测时间线

模型家族

查看全部家族 →