此页是 2026-08-20 的观测快照,查看该模型当前信息 → /m/empero-ai__qwen38-9b-distill/
归档 / 2026-08-20 / Qwen3.8-9B-Distill-GGUF (Empero)
Qwen3.8-9B-Distill-GGUF (Empero)
- 入选理由
- Qwen3.8蒸馏到9B的GGUF,支持llama.cpp/Ollama直接运行,性能较Qwen3.5-9B显著提升,适合本地部署的推理用户。
- 对位
- 对位 Qwen3.5-9B / Llama-3-8B
- 适合
- 本地 GGUF 推理部署 / 数学与通用知识问答
- 不适合
- 旧版 llama.cpp 环境
- 规模
- 9B · 未知 · Q4 ~5.9GB / FP16 ~22GB
- 授权
- apache-2.0 · 需自查
- 框架
- llama.cpp / ollama / lmstudio / jan / koboldcpp
- 血统
- 量化自 Qwen3.8-9B
- 可信度
- 下载量 71.5k / 点赞 101; 源模型 mmlu CoT 0.751
快速上手示例
ollama run hf.co/empero-ai/Qwen3.8-9B-Distill-GGUF 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 3 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 11
HuggingFace 原始数据 (抓取于 2026-08-20)
- 作者
- empero-ai
- 推理库
- gguf
- 下载
- 71,582
- 点赞
- 101
- 许可证
- apache-2.0
- 标签
- gguf, llama.cpp, quantized, empero-ai, qwen3.5, qwen3.8, distillation, reasoning, gated-deltanet, text-generation, en, base_model:empero-ai/Qwen3.8-9B-Distill, base_model:quantized:empero-ai/Qwen3.8-9B-Distill, license:apache-2.0, endpoints_compatible, region:us, conversational
探索
源链接