SummFlow 2026-06-22 Hugging Face

Qwythos-9B-Claude-Mythos-5-1M (Empero)

基于Qwen3.5的推理模型,1M上下文,支持函数调用

入选理由
基于Qwen3.5-9B微调的推理模型量化版,支持1M上下文和视觉输入,Ollama一键运行,需至少8GB显存或CPU。
对位
对位 Gemma-2-9B / Llama-3.1-8B
适合
复杂推理任务(生物/安全) / 长上下文文档分析(1M)
不适合
低延迟对话聊天
规模
9B · 1M
授权
Apache-2.0 · 需自查
框架
llama.cpp / ollama / lm-studio
工具调用
Qwen3.5 原生 <tool_call> 格式
血统
量化自 Qwythos-9B-Claude-Mythos-5-1M
可信度
对比Qwen3.5-9B,MMLU +34,gsm8k-strict +30,全参数后训练

社区实测

工具调用和补丁编辑在 Q8 量化下可用,但长上下文下容易陷入循环和错误操作

  • Q8 量化下工具调用可用,补丁式代码编辑表现良好
  • 1M 长上下文窗口,支持全代码库推理和多文档研究
  • Apache 2.0 许可,9B 参数可运行在消费级硬件上
  • 原生支持 OpenAI/Qwen3.5 风格函数调用,无需额外封装
  • 上下文窗口增大后出现循环和错误操作,可能与采样参数设置有关
  • 非通用聊天模型,是推理模型,需严格按模型卡指定采样参数使用

截至 2026-07-08

快速上手

ollama run hf.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF