指南 / 智能体模型 / 可用 CPU 运行

可用 CPU 运行的智能体模型

共 18 个

Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox) 无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理 MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking (GnLOLot) 1B 工具调用思考模型 GGUF 量化,本地运行 MaralGPT-Mythos-9B (MaralGPT) 无审查 Qwen3.5-9B 微调,用于网络安全与生物医学 Gemma-4-12B Agentic v2 (yuxinlu1) 编程与工具调用代理微调,供开发者本地使用 Huihui-Qwythos-9B-1M (huihui-ai) 未审查 1M 上下文 Qwen3.5 微调,支持工具调用 Qwopus-3.6-35B-A3B-Coder (Jackrong) 关闭思考的编码代理模型,降低 token 延迟,适合本地工作流 Qwen-AgentWorld-35B-A3B (Qwen) 语言世界模型,模拟7类agent交互环境 Gemma-4-31B-it (Google) IQ2_M 31B 多模态 Agent,10 GiB 本地运行 Qwen3.6-27B-AEON-Uncensored (AEON-7) 无审查的27B视觉语言模型,用于多模态对话与图像理解 Qwen3.6-27B-Uncensored (AEON-7/mradermacher) 27B 无审查多模态混合模型,本地创作者使用 Qwopus3.6-27B-Coder (Jackrong) 27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用 Qwythos-9B (Empero) 开源 9B 推理模型,不审查,支持 1M 上下文和函数调用 Qwen3.6-27B-MTP-pi-tune (bytkim) 面向无思考代理编码的MTP微调版,本地GGUF推理 Qwopus-3.6-27B-Coder (Jackrong) 面向代理编码与工具调用的27B推理模型 North-Mini-Code-1.0 (CohereLabs) 30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务 MiniCPM5-1B (OpenBMB) 1B 模型 GGUF 量化,本地 agent 与边缘部署用 Qwopus3.6-27B-v2-MTP-GGUF (Jackrong) 多Token预测推理模型,面向编码、数学、DevOps开发者 Qwopus3.5-9B-Coder-MTP (Jackrong) 9B多令牌预测代码模型,GGUF量化,面向代码推理