此页是 2026-08-18 的观测快照,查看该模型当前信息 → /m/empero-ai__qwen38-9b/
归档 / 2026-08-18 / Qwen3.8-9B (Empero)
Qwen3.8-9B (Empero)
- 入选理由
- 有清晰transformers示例,但依赖flash-linear-attention等内核,需自行配置。基于Qwen3.5-9B全参数蒸馏,MMLU大幅提升,支持函数调用与262K上下文,适合单卡部署的推理场景。
- 对位
- 对位 Qwen3.5-9B / Llama-3-8B
- 适合
- 数学与代码推理问答 / 函数调用与长上下文任务
- 不适合
- 视觉或多模态任务(未评估)
- 规模
- 9B · 262k · Q4 ~6.4GB / FP16 ~23GB
- 授权
- Apache-2.0 · 需自查
- 框架
- transformers / vllm / sglang
- 工具调用
- Qwen3.5 规范 function calling
- 血统
- 微调自 Qwen3.5-9B
- 可信度
- 自报 MMLU CoT 57科 acc 0.751,底模 0.546
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve empero-ai/Qwen3.8-9B 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 3 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 7
HuggingFace 原始数据 (抓取于 2026-08-18)
- 作者
- empero-ai
- 推理库
- transformers
- 下载
- 540
- 点赞
- 108
- 许可证
- Apache-2.0
- 标签
- transformers, safetensors, qwen3_5, image-text-to-text, empero-ai, qwen3.5, qwen3.8, distillation, reasoning, function-calling, sft, text-generation, conversational, en, base_model:Qwen/Qwen3.5-9B, base_model:finetune:Qwen/Qwen3.5-9B, license:apache-2.0, endpoints_compatible, region:us
探索
源链接