Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox)
无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理
社区实测
这是一个社区驱动的无审查版 Qwen3.6-35B-A3B,通过纯数值修复恢复了原版中约 750 万死神经元和 SSM 层张量漂移,Genesis 版本是当前最完善的迭代。社区讨论集中在版本选择上,Plus 版因一致性测试失败已被作者撤回,作者建议 Genesis 版搭配 MXFP4_MOE 量化或 Wasserstein 版 Q4_K_P 以上量化使用。
- 去除原版审查,声称 0/465 次拒绝,完全保留原版能力
- 修复 FFN 专家层中约 750 万死神经元/零块,恢复专家多样性
- 修复 SSM conv1d 层的张量漂移,改善长上下文记忆能力
- Genesis 版本恢复后可进行微调
- 兼容 llama.cpp、LM Studio、koboldcpp 等主流 GGUF 运行时
- 提供多种量化版本,适配不同硬件条件
- 系统提示词必须以特定首行开头,否则模型表现可能下降
- 量化低于 Q4_K_P 时编程能力显著下降
- Plus 版本因一致性基准测试失败已被作者撤回
- Wasserstein(非 Plus)版本仅修复 SSM 层漂移,未修复死神经元
- 不同版本的推荐量化格式不同(Genesis 推荐 MXFP4_MOE,Wasserstein 推荐 Q4_K_P)
来源
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-GGUF · Hugging FaceLuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Wasserstein-GGUF · Hugging FaceLuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-safetensors · Hugging FaceLuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Wasserstein-GGUF · difference with LuffyTheFox/Qwen3.6-35B-A3B-Plus-Uncensored-Wasserstein-GGUF ?
截至 2026-07-19
本形态显存 Q4 ~23GB / FP16 ~84GB · 国内 需代理 · 13,390 下载
快速上手
llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF --jinja