模型 / Qwen3.8-27B-Ridge-GGUF (empero-ai)

Qwen3.8-27B-Ridge-GGUF (empero-ai)

Qwen3.8-27B 混合量化 GGUF,本地图文推理

作者 empero-ai

仓库标识empero-ai/Qwen3.8-27B-Ridge-GGUF

~16GB 4-bit许可 可商用任务 视觉理解最近核对 2026-08-17
格式
4-bit
文件
~14GB
运行内存
~16GB–21GB
运行时
OLLAMA
下载
3,351

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/empero-ai/Qwen3.8-27B-Ridge-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen3.8-27B 的 GGUF 量化,可直接用 llama.cpp/Ollama,保留 26 万上下文和视觉,11.7GB 适合 16GB 显存,混合量化方案低 PPL。
对位
对位 Qwen3-32B / Gemma-3-27B
适合
本地 GGUF 图文推理与部署 / 低比特量化长上下文文本生成
不适合
需未量化精度的关键任务

完整规格

规模
27B · 262k / YaRN 1M · 下载 ~14GB · 显存最低 ~16GB · 推荐 ~21GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
llama.cpp / ollama / lmstudio / koboldcpp
工具调用
Qwen3.8 模板 <tool_call>…</tool_call>
血统
量化自 Qwen3.8-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 211.7k → 350.7k

观测时间线

模型家族

查看全部家族 →