指南 / 视觉理解模型 / 可商用

可商用的视觉理解模型

共 11 个

PP-OCRv6_medium_det (PaddlePaddle) 轻量级多语言文本检测模型,48语种,服务端/边缘可用 DiffusionGemma-26B-A4B-it (Google) 离散扩散文本生成,支持图像/视频输入,低延迟 Gemma-4-31B-QAT-GGUF (unsloth) Gemma 4 31B 量化图文模型,支持工具调用,本地部署 Gemma-4-26B-A4B-QAT-GGUF (Unsloth) Gemma 4 26B MoE 量化版,用于本地图像与文本推理 NuExtract3 (NuMind) 文档结构化提取和Markdown转换的4B视觉语言模型 Qwen3.5-9B-MTP-GGUF (unsloth) Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行 Qwen3.6-27B-GGUF (unsloth) 27B参数GGUF版,本地AI原型开发 Qwen3.6-35B-A3B-GGUF (Unsloth) 35B MoE仅3B激活的GGUF量化版,适合本地中文开发 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF (DavidAU) 解禁版Qwen3.6-27B量化模型,为创意写作与代码而生 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 35B MoE多模态去审查模型,适合本地无限制输出 Qwen3.6-40B (DavidAU) 多模态无审查推理模型,面向代码与视觉应用