SummFlow 2026-05-16 Hugging Face

Qwen3.6-40B (DavidAU)

多模态无审查推理模型,面向代码与视觉应用

入选理由
GGUF格式可本地或Ollama即用;下载量20万,社区关注度高;基于Qwen3.6扩展至40B并微调,基准有提升。
对位
Qwen 官方模型的无审查替代版
适合
无审查代码生成与推理 / 多模态图像理解
不适合
需要内容过滤的生产场景
规模
40B · 未知
授权
apache-2.0 · 可商用
框架
llama.cpp / ollama
血统
量化自 Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking
可信度
HuggingFace 总下载 207k,点赞 94

社区实测

社区对 DavidAU 的 Qwen Opus 推理微调系列整体评价偏正面,认为实际可用,但对超长命名和"Opus"标签的营销成分持调侃态度。

  • 通过 Heretic 方法移除安全过滤,满足无审查使用需求
  • 基于 Claude Opus 4.6 推理轨迹微调,提升了推理能力
  • 在 16GB 显存 + RAM 卸载的消费级硬件上以 q4_k_m 量化跑出 24 t/s,部署门槛可控
  • 模型名过长,社区以调侃方式表达不满
  • "Opus"标签被质疑更多是命名营销而非实质提升
  • 性能对比仅止于"不更差",缺乏明确的优势证据

截至 2026-06-19

快速上手

llama-cli -m <gguf-file> -p '你的提示'