Qwythos-9B-v2 (Empero AI)
修复循环生成并保留1M上下文推理能力的研究型模型
仅 safetensors · 无 pickle 加载风险
社区实测
v2 用 FTP 微调把 v1 在贪婪解码下反复出现的循环/重复问题从 6.7% 降到 0%,推理能力和知识水平与 v1 持平,是一个针对性修复而非全面提升。
- 修复了 v1 在贪婪解码或低温度下反复出现的循环/重复问题(6.7%→0%)
- 让贪婪解码(temp 0)保持连贯输出,不再需要设置 repeat-penalty
- v1 在 gpqa_diamond 上比基座 Qwen3.5-9B 低 5 分,v2 声称与 v1 持平而非提升,基准测试退化的问题可能仍在
- 该模型基于从闭源 Claude 模型蒸馏的合成数据训练,存在版权/合规争议
来源
Qwythos-9B-v2 Fixes AI Repetition Without Hurting ...empero-ai/Qwythos-9B-v2-GGUF : r/LocalLLaMAQwythos-9B-v2 — we trained the looping behavior out (6.7 ...Empero released an uncensored Qwythos-9B model — and said it trained it on data from the closed Claude Mythos | dev.ua
截至 2026-07-19
本形态 ~5.8GB 4-bit · 国内 需代理 · 993 下载
仅 safetensors · 无 pickle 加载风险
快速上手
vllm serve empero-ai/Qwythos-9B-v2 --trust-remote-code 本形态 ~5.4GB 4-bit · 国内 需代理 · 15,523 下载
快速上手
ollama run hf.co/empero-ai/Qwythos-9B-v2-GGUF:Q4_K_M 下载动量
30天下载 2.5k → 9.5k
观测时间线
模型家族
- Qwen3.5-9B
- 量化 MaralGPT-Mythos-9B (MaralGPT)
- 量化 Qwen3.5-9B (Qwen)
- 量化 Qwen3.5-9B-MTP-GGUF (unsloth)
- 量化 Qwen3.5-9B-OptiQ-4bit (mlx-community)
- 微调 Qwythos-9B (Empero)
- 微调 Qwythos-9B-v2 (Empero AI)