16GB 显存能跑的智能体模型
共 19 个
显存档为包含式:更低显存也能跑的模型一并列在此。数值取 Q4 量化后显存估算。
MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking (GnLOLot) 1B 工具调用思考模型 GGUF 量化,本地运行 MaralGPT-Mythos-9B (MaralGPT) 无审查 Qwen3.5-9B 微调,用于网络安全与生物医学 Gemma-4-12B Agentic v2 (yuxinlu1) 编程与工具调用代理微调,供开发者本地使用 Gemma4-26B-A4B (HauhauCS) 无审查Gemma4-26B MoE,适用于代理编码与创意写作 Huihui-Qwythos-9B-1M (huihui-ai) 未审查 1M 上下文 Qwen3.5 微调,支持工具调用 Gemma-4-31B-it (Google) IQ2_M 31B 多模态 Agent,10 GiB 本地运行 Qwen3.6-27B-AEON-Uncensored (AEON-7) 无审查的27B视觉语言模型,用于多模态对话与图像理解 Qwen3.6-27B-Uncensored (AEON-7/mradermacher) 27B 无审查多模态混合模型,本地创作者使用 Gemma4-12B-Uncensored (HauhauCS) 解除审查的Gemma4多模态模型,面向代理编码与创意写作 Qwopus3.6-27B-Coder (Jackrong) 27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用 Qwythos-9B (Empero) 开源 9B 推理模型,不审查,支持 1M 上下文和函数调用 Qwen3.6-27B-MTP-pi-tune (bytkim) 面向无思考代理编码的MTP微调版,本地GGUF推理 Qwopus-3.6-27B-Coder (Jackrong) 面向代理编码与工具调用的27B推理模型 MiniCPM5-1B (OpenBMB) 1B 模型 GGUF 量化,本地 agent 与边缘部署用 Qwopus3.6-27B-v2-MTP-GGUF (Jackrong) 多Token预测推理模型,面向编码、数学、DevOps开发者 Qwopus3.5-9B-Coder-MTP (Jackrong) 9B多令牌预测代码模型,GGUF量化,面向代码推理 SuperGemma4-26B (Jiunsong) Gemma4 26B 无审查 MLX, 本地代理加速 Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS) Gemma4 无审查多模态 MoE,面向创意写作与角色扮演 SuperGemma4-26B-Uncensored (Jiunsong) 无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理