模型 / Qwen3.8-9B-Distill (Empero)

Qwen3.8-9B-Distill (Empero)

全参蒸馏 9B 推理模型,面向数学/代码/工具调用

作者 empero-ai

仓库标识empero-ai/Qwen3.8-9B-Distill

~5.8GB 4-bit许可 可商用任务 智能体最近核对 2026-08-20

仅 safetensors · 无 pickle 加载风险

格式
4-bit
文件
~5GB
运行内存
~5.8GB–7.5GB
运行时
VLLM
下载
4,354

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve empero-ai/Qwen3.8-9B-Distill

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
基于 Qwen3.5-9B 的全参数蒸馏模型,数学与代码推理增强,原生函数调用,需自备推理环境和特殊 kernel。适合关注小体积强推理的开发者。
对位
对位 Qwen3-8B / Llama-3.1-8B
适合
数学与代码链式推理 / 工具调用与指令遵循
不适合
视觉多模态任务(未评估)

完整规格

规模
9B · 262k · 下载 ~5GB · 显存最低 ~5.8GB · 推荐 ~7.5GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
transformers / vllm / sglang
工具调用
Qwen3.5 规范 function calling
血统
微调自 Qwen3.5-9B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 16.2k → 22.7k

观测时间线

模型家族

查看全部家族 →