SummFlow 2026-07-19 Hugging Face

Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox)

无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理

入选理由
基于 Qwen3.6 的 MoE 多模态 GGUF,经信号修复和 Hermes 微调,可直接用 llama.cpp,适合 12GB 显存本地部署。
对位
对位 Qwen2.5-3B 密集模型(激活参数约 3B)
适合
无审查对话与多模态问答 / 本地 agent 工具调用
不适合
需安全审查的生产环境
规模
35B (3B 激活) · 262K (可扩展至 1M) · Q4 ~23GB / FP16 ~84GB
授权
Apache-2.0 · 需自查
框架
llama.cpp / ollama / LM Studio / koboldcpp
工具调用
Hermes 风格 function calling
可信度
HuggingFace 1.3 万下载,57 点赞,基于 Qwen3.6 与开源 Hermes 数据集

快速上手

llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF --jinja