此页是 2026-08-18 的观测快照,查看该模型当前信息 → /m/empero-ai__qwen38-9b/

归档 / 2026-08-18 / Qwen3.8-9B (Empero)

Qwen3.8-9B (Empero)

9B 蒸馏推理模型,面向数学/代码/工具调用

入选理由
有清晰transformers示例,但依赖flash-linear-attention等内核,需自行配置。基于Qwen3.5-9B全参数蒸馏,MMLU大幅提升,支持函数调用与262K上下文,适合单卡部署的推理场景。
对位
对位 Qwen3.5-9B / Llama-3-8B
适合
数学与代码推理问答 / 函数调用与长上下文任务
不适合
视觉或多模态任务(未评估)
规模
9B · 262k · Q4 ~6.4GB / FP16 ~23GB
授权
Apache-2.0 · 需自查
框架
transformers / vllm / sglang
工具调用
Qwen3.5 规范 function calling
血统
微调自 Qwen3.5-9B
可信度
自报 MMLU CoT 57科 acc 0.751,底模 0.546

仅 safetensors · 无 pickle 加载风险

快速上手示例

vllm serve empero-ai/Qwen3.8-9B

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-08-18)

作者
empero-ai
任务类型
text-generation
推理库
transformers
下载
540
点赞
108
许可证
Apache-2.0
标签
transformers, safetensors, qwen3_5, image-text-to-text, empero-ai, qwen3.5, qwen3.8, distillation, reasoning, function-calling, sft, text-generation, conversational, en, base_model:Qwen/Qwen3.5-9B, base_model:finetune:Qwen/Qwen3.5-9B, license:apache-2.0, endpoints_compatible, region:us

探索

源链接