SummFlow 2026-06-23 Hugging Face

Qwythos-9B (Empero)

开源 9B 推理模型,不审查,支持 1M 上下文和函数调用

入选理由
Qwen3.5-9B全参数微调,推理能力显著提升,支持1M上下文和函数调用,适合长文本与工具代理场景,需自行安装额外内核依赖。
对位
对位 Qwen3.5-9B
适合
长上下文推理与工具调用 / 网络安全 / 生物医学等敏感技术问答
不适合
需要安全审查的生产部署
规模
9B · 1M · Q4 ~6.2GB / FP16 ~23GB
授权
Apache 2.0 · 需自查
框架
vllm / transformers
工具调用
Qwen3.5 原生函数调用(OpenAI 兼容格式)
血统
微调自 Qwen3.5-9B
可信度
MMLU 提升 34.3 分,gsm8k 严格匹配提升 30 分,同 harness 同采样验证

仅 safetensors · 无 pickle 加载风险

社区实测

社区视其为可在消费级 GPU 本地运行的无审查 9B 推理模型,但独立实测反馈稀少,基准宣称被指'嘈杂'。

  • 可在消费级 GPU 上本地运行
  • 无审查/无过滤输出
  • 支持 100 万 token 上下文窗口
  • 基准测试卡被第三方评价为'嘈杂'
  • 首批公开样本因采样参数配置错误导致部分结果有误

截至 2026-06-28

快速上手

vllm serve empero-ai/Qwythos-9B-Claude-Mythos-5-1M --max-model-len 1010000