此页是 2026-08-17 的观测快照,查看该模型当前信息 → /m/empero-ai__qwen38-27b-ridge-gguf/

归档 / 2026-08-17 / Qwen3.8-27B-Ridge-GGUF (empero-ai)

Qwen3.8-27B-Ridge-GGUF (empero-ai)

Qwen3.8-27B 混合量化 GGUF,本地图文推理

入选理由
Qwen3.8-27B 的 GGUF 量化,可直接用 llama.cpp/Ollama,保留 26 万上下文和视觉,11.7GB 适合 16GB 显存,混合量化方案低 PPL。
对位
对位 Qwen3-32B / Gemma-3-27B
适合
本地 GGUF 图文推理与部署 / 低比特量化长上下文文本生成
不适合
需未量化精度的关键任务
规模
27B · 262k / YaRN 1M · Q4 ~18GB / FP16 ~65GB
授权
Apache-2.0 · 需自查
框架
llama.cpp / ollama / lmstudio / koboldcpp
工具调用
Qwen3.8 模板 <tool_call>…</tool_call>
血统
量化自 Qwen3.8-27B
可信度
HF 3351 下载 / 81 点赞;实测 PPL 7.82,较 BF16 +9.3%

快速上手示例

ollama run hf.co/empero-ai/Qwen3.8-27B-Ridge-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-17)

作者
empero-ai
任务类型
image-text-to-text
推理库
gguf
下载
3,351
点赞
81
许可证
Apache-2.0
标签
gguf, llama.cpp, quantized, qwen3.8, qwen3.5, ridge, gated-deltanet, imatrix, reasoning, multimodal, vision, mtp, long-context, image-text-to-text, en, zh, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, endpoints_compatible, region:us, conversational

探索

源链接