SummFlow 2026-06-26 Hugging Face

Qwen3.6-27B-Uncensored (AEON-7/mradermacher)

27B 无审查多模态混合模型,本地创作者使用

入选理由
GGUF格式可用Ollama直接运行,下载量超3万,适合本地部署未经审查的多模态对话模型,要求显存约10-28GB。
对位
对位 Gemma 2 27B
适合
无审查对话与角色扮演 / 多模态图像与文档理解
不适合
需要内容过滤的生产环境
规模
27B · 未知
授权
apache-2.0 · 需自查
框架
llama.cpp / ollama / LM Studio
工具调用
OpenAI-compatible
血统
量化自 Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16
可信度
基于 Qwen3.6-27B 去审查版,量化下载 3.1 万,提供多种位宽

社区实测

Qwen3.6-27B 作为 27B 稠密模型,在编程基准上超越了自家 397B MoE 前代,社区普遍认为它是当前同体量编程最强模型之一,量化后可在一张 24GB 消费卡上流畅运行,性价比极高。但社区也明确提醒:它不是 Claude 的替代品,别被过度吹捧带偏。

  • 编程能力超越 Qwen3.5-397B-A17B 等大得多的模型
  • 16.8GB 量化版仅需约 20GB 内存即可本地运行,部署门槛低
  • 稠密架构比 MoE 更易部署,无需复杂路由
  • 社区已产出多种无审查变体(Aggressive 零拒绝、Heretic 6/100 拒绝率),审查规避需求得到满足
  • abliteration 无审查处理不损伤 MTP 投机解码性能,速度不降
  • Apache 2.0 许可,允许商用
  • 实际编码体验优于同代 Qwen3.6 35B-A3B(MoE)
  • 支持 llama.cpp 本地推理
  • 并非 Claude 替代品,社区认为这样比较的人要么没用过 Claude 要么在妄想
  • BF16 全精度需 52GB 显存,单卡消费级跑不了
  • DGX Spark 专用容器不可移植到其他硬件
  • Aggressive 无审查变体被指「毫无个性」
  • SVG 生成质量不稳定,曾出现「放飞自我」的输出

截至 2026-06-28

快速上手

llama-server -hf mradermacher/Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16-GGUF