24GB 显存能跑的视觉理解模型
共 16 个
显存档为包含式:更低显存也能跑的模型一并列在此。数值取 Q4 量化后显存估算。
Qwen3.6-27B-Fable-Fusion (DavidAU) 多阶段微调的27B视觉模型,提升推理与创意写作 FrickFritz-4B-GGUF (fattis) GGUF 量化,解禁角色扮演与图像描述 ThinkingCap-Qwen3.6-27B (bottlecapai) 视觉语言模型,思考令牌减半,GGUF量化,适合本地运行 Unlimited-OCR (Baidu) 3B 视觉语言 OCR 模型,文档解析与 Markdown 转换 PP-OCRv6_medium_det (PaddlePaddle) 轻量级多语言文本检测模型,48语种,服务端/边缘可用 DiffusionGemma-26B-A4B-it (Google) 离散扩散文本生成,支持图像/视频输入,低延迟 Gemma-4-31B-QAT-GGUF (unsloth) Gemma 4 31B 量化图文模型,支持工具调用,本地部署 Gemma-4-26B-A4B-QAT-GGUF (Unsloth) Gemma 4 26B MoE 量化版,用于本地图像与文本推理 NuExtract3 (NuMind) 文档结构化提取和Markdown转换的4B视觉语言模型 Qwen3.5-9B-MTP-GGUF (unsloth) Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行 Qwen3.6-27B-GGUF (unsloth) 27B参数GGUF版,本地AI原型开发 Qwen3.6-35B-A3B-GGUF (Unsloth) 35B MoE仅3B激活的GGUF量化版,适合本地中文开发 Gemma-4-E4B-Aggressive (HauhauCS) 无审查的Gemma 4多模态模型,适合内容生成开发者 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF (DavidAU) 解禁版Qwen3.6-27B量化模型,为创意写作与代码而生 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 35B MoE多模态去审查模型,适合本地无限制输出 Qwen3.6-40B (DavidAU) 多模态无审查推理模型,面向代码与视觉应用