模型 / Qwen3.8-9B (Empero)

Qwen3.8-9B (Empero)

9B 蒸馏推理模型,面向数学/代码/工具调用

作者 empero-ai

仓库标识empero-ai/Qwen3.8-9B

~5.8GB 4-bit许可 可商用任务 智能体最近核对 2026-08-18
格式
4-bit
文件
~5GB
运行内存
~5.8GB–7.5GB
运行时
VLLM
下载
540

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve empero-ai/Qwen3.8-9B

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
有清晰transformers示例,但依赖flash-linear-attention等内核,需自行配置。基于Qwen3.5-9B全参数蒸馏,MMLU大幅提升,支持函数调用与262K上下文,适合单卡部署的推理场景。
对位
对位 Qwen3.5-9B / Llama-3-8B
适合
数学与代码推理问答 / 函数调用与长上下文任务
不适合
视觉或多模态任务(未评估)

完整规格

规模
9B · 262k · 下载 ~5GB · 显存最低 ~5.8GB · 推荐 ~7.5GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
transformers / vllm / sglang
工具调用
Qwen3.5 规范 function calling
血统
微调自 Qwen3.5-9B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 16.2k → 22.7k

观测时间线

模型家族

查看全部家族 →