SummFlow 2026-07-10 Hugging Face

ThinkingCap-Qwen3.6-27B (bottlecapai)

视觉语言模型,思考令牌减半,GGUF量化,适合本地运行

入选理由
Qwen3.6-27B微调版,推理token减半并保持质量,提供GGUF和视觉支持,适合本地高效部署,无硬性门槛。
对位
对位 Qwen3.6-27B 原版及同类27B视觉模型
适合
需要思维链但希望节省Token成本 / 本地视觉问答与推理部署
不适合
长链深度推理,精度可能略降
规模
27B · 未知 · Q4 ~18GB / FP16 ~65GB
授权
unknown · 需自查
框架
llama.cpp / ollama
血统
量化自 ThinkingCap-Qwen3.6-27B
可信度
近30万次下载,Q4_K_M精度与f16相当,MTP解码速度提升约1.5倍

快速上手

llama-server -hf bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:Q4_K_M --mmproj bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:mmproj-ThinkingCap-Qwen3.6-27B-f16.gguf