Qwen3.6-40B (DavidAU)
多模态无审查推理模型,面向代码与视觉应用
仓库标识DavidAU/Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
~84GB BF16许可 可商用任务 视觉理解最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(GGUF)。
- 格式
- BF16
- 文件
- ~73GB
- 运行内存
- ~84GB–109GB
- 运行时
- llama.cpp
- 下载
- 207,104
适合与不适合
独立证据与社区反馈
社区口碑分化明显:部分用户将其作为日常主力模型,认为输出可接受且连贯,能长时间无人值守运行 agent;但也有人质疑 40B 相比 27B 基座提升有限,质量存在争议。定位偏向服务器级硬件部署,在 RTX 5090 上推理速度不错,但基准测试均为开发者自测,缺乏第三方独立验证。
- 提供可接受且连贯的输出,满足日常使用需求
- 能长时间无人值守运行 agent(约一小时)
- 去除拒绝回答的限制,实现无审查输出
- 在 RTX 5090 上 Q4_K_S 量化推理速度约 75 t/s
- 通过 Deckard 扩展技术将参数规模提升至 40B,适合服务器 GPU 部署
- 质量存在争议,有用户认为「好坏难说」
- 相比 27B 基座模型提升不明显,有用户认为 40B 未表现出更强能力
- 基准测试数据为开发者团队自测,未经第三方独立验证
- MTP 量化模式需严格控制温度 < 1 且 repetition penalty = 1,否则性能下降
- 40B 参数规模需要服务器级 GPU,不适用于消费级硬件
- 视频实测中 40B 未能完成提示设定的核心功能,速度也慢于 27B+MTP
- 社区实测DavidAU somehow managed to improve Qwen 3.6 27B
- 社区实测Thoughts on `DavidAU/Qwen3.6-40B-Claude-4.6-Opus ...
- 社区实测Be wary of Qwen/Claude distillations - they're often worse ...
- 独立评测Qwen3.6 27B MTP против Qwen3.6 40B - Битва LLM на RTX 5090
- 独立评测Community Modification That Surpassed the Official Qwen3.6-27B: A Thorough Explanation of DavidAU's "Fable-Fusion-711"|アイドリ | AI-Driven Lab
- 独立评测The Fine-Tuned Variant of Qwen3.6-27B That Achieved an ...
可信度HuggingFace 总下载 207k,点赞 94
完整规格
下载动量
30天下载 488.9k → 465.1k · likes +36