Qwen3.5-9B-Defiant-Fable (DavidAU)
无审查9B多模态模型,提升推理与指令跟随
仓库标识DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
~5.4GB 4-bit许可 需自查任务 视觉理解最近核对 2026-08-05
- 格式
- 4-bit
- 文件
- ~4.7GB
- 运行内存
- ~5.4GB–7GB
- 运行时
- LLAMA-SERVER
- 下载
- 41,268
快速上手示例
llama-server -hf DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
Qwen3.5-9B在9B级模型中性能突出,能在12-16GB VRAM消费级硬件上流畅运行,agentic coding场景表现惊喜,但代码生成有幻觉问题、推理链偶尔失控,是日常小任务和实验的实用选择而非生产级替代品。
- 9B参数即可在12-16GB VRAM硬件上运行,部署门槛低
- 在ARC-C等7项基准测试上超越同尺寸9B乃至27B模型
- 4-bit和8-bit量化下均保持640+ ARC-C分数
- agentic coding/工具调用场景表现出色,支持长时间无人值守agent运行
- 速度够快,响应'snappy',适合日常小任务
- 0/465拒绝率,uncensored无审查
- 9B推理成本远低于27B($0.14 vs $0.51/百万token)
- 使用MTP量化可在RTX 5090上超过90 tokens/s
- 代码生成幻觉严重,会编造不存在的API
- 推理链偶尔失控,思维token出现不可控状态
- 在agentic coding方面仍落后于Claude
- MTP量化需温度<1且关闭重复惩罚,否则性能下降
- 长时间运行可能感觉慢且不稳定
- DavidAU过往模型口碑参差,部分用户对其持保留态度
- 基准测试分数与实际表现存在差距,不可全信榜单
- 独立评测Qwen3.6-27B Fable Fusion Breaks the 700 ARC-C Barrier
- 社区实测Just want to echo the recommendation for qwen3.5:9b. This is a smol, thinking, a... | Hacker News
- 社区实测Qwen3.5-9B is actually quite good for agentic coding : r/LocalLLaMA
- 社区实测A bit of a PSA: I get that Qwen3.5 is all the rage right now ...
- 社区实测DavidAU somehow managed to improve Qwen 3.6 27B
- 社区实测Qwen3.5-9B Uncensored Aggressive Release (GGUF)
- 独立评测Qwen3.5-9B tops every AI benchmark right now, but that's ...
- 独立评测Qwen 3.5: The Complete Guide - Benchmarks, Local Setup ...
- 独立评测Qwen3.5 9B (Reasoning) vs Qwen3.5 27B (Reasoning): Model Comparison
- 独立评测Community Modification That Surpassed the Official Qwen3.6-27B
- 官方/厂商DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
可信度下载量41k,点赞58,模型卡列详细基准
完整规格
下载动量
30天下载 778.2k → 872.9k · likes +259