模型 / Qwythos-9B-v2 (Empero AI)

Qwythos-9B-v2 (Empero AI)

修复循环生成并保留1M上下文推理能力的研究型模型

作者
empero-ai
对位
对位 Qwen3.5-9B
适合
长文本推理与代码生成 / 未过滤的研究与安全测试
不适合
需要高吞吐编码辅助的场景
入选理由
修复Qwythos循环问题并保持推理能力,1M上下文、无审查,适合长文本推理与安全研究,需自行部署transformers或vLLM。
规模
9B · 1048k · 最低 ~5.8GB · 4-bit(估算)
授权
Apache-2.0 · 需自查
框架
vllm / transformers
血统
微调自 Qwythos-9B-Claude-Mythos-5-1M
国内访问
需代理
可信度
71 点赞,基于 Qwen3.5-9B,FTPO 修正循环问题,基准测试保持

仅 safetensors · 无 pickle 加载风险

社区实测

v2 用 FTP 微调把 v1 在贪婪解码下反复出现的循环/重复问题从 6.7% 降到 0%,推理能力和知识水平与 v1 持平,是一个针对性修复而非全面提升。

  • 修复了 v1 在贪婪解码或低温度下反复出现的循环/重复问题(6.7%→0%)
  • 让贪婪解码(temp 0)保持连贯输出,不再需要设置 repeat-penalty
  • v1 在 gpqa_diamond 上比基座 Qwen3.5-9B 低 5 分,v2 声称与 v1 持平而非提升,基准测试退化的问题可能仍在
  • 该模型基于从闭源 Claude 模型蒸馏的合成数据训练,存在版权/合规争议

截至 2026-07-19

本形态 ~5.8GB 4-bit · 国内 需代理 · 993 下载

仅 safetensors · 无 pickle 加载风险

快速上手

vllm serve empero-ai/Qwythos-9B-v2 --trust-remote-code

本形态源 ↗

下载动量

30天下载 2.5k → 9.5k

观测时间线

模型家族

查看全部家族 →