此页是 2026-08-20 的观测快照,查看该模型当前信息 → /m/empero-ai__qwen38-9b-distill/

归档 / 2026-08-20 / Qwen3.8-9B-Distill-GGUF (Empero)

Qwen3.8-9B-Distill-GGUF (Empero)

9B 蒸馏推理模型 GGUF 量化,本地部署用

入选理由
Qwen3.8蒸馏到9B的GGUF,支持llama.cpp/Ollama直接运行,性能较Qwen3.5-9B显著提升,适合本地部署的推理用户。
对位
对位 Qwen3.5-9B / Llama-3-8B
适合
本地 GGUF 推理部署 / 数学与通用知识问答
不适合
旧版 llama.cpp 环境
规模
9B · 未知 · Q4 ~5.9GB / FP16 ~22GB
授权
apache-2.0 · 需自查
框架
llama.cpp / ollama / lmstudio / jan / koboldcpp
血统
量化自 Qwen3.8-9B
可信度
下载量 71.5k / 点赞 101; 源模型 mmlu CoT 0.751

快速上手示例

ollama run hf.co/empero-ai/Qwen3.8-9B-Distill-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   3 / 5
总分
11

HuggingFace 原始数据 (抓取于 2026-08-20)

作者
empero-ai
任务类型
text-generation
推理库
gguf
下载
71,582
点赞
101
许可证
apache-2.0
标签
gguf, llama.cpp, quantized, empero-ai, qwen3.5, qwen3.8, distillation, reasoning, gated-deltanet, text-generation, en, base_model:empero-ai/Qwen3.8-9B-Distill, base_model:quantized:empero-ai/Qwen3.8-9B-Distill, license:apache-2.0, endpoints_compatible, region:us, conversational

探索

源链接