多模态 27B 模型,纯 Q1_0 量化,语言部分仅 3.8 GB
适合低显存本地多模态聊天 / 图片描述与视觉问答
短板复杂文档视觉解析
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查
证据218 下载 / 3 赞
多模态 27B 模型,纯 Q1_0 量化,语言部分仅 3.8 GB
适合低显存本地多模态聊天 / 图片描述与视觉问答
短板复杂文档视觉解析
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查
证据218 下载 / 3 赞
35B开源语言模型,GGUF格式便于本地部署
适合本地化对话与内容生成 / 代码辅助与文本创作
短板多模态任务或生产关键系统
Q4 ~23GB / FP16 ~84GB · MIT · 未知 · llama.cpp需自查
证据111 下载
LM Studio 提供的 GGUF 量化版,适用本地部署
适合对话生成 / 文本续写
短板高精度知识问答(量化)
Q4 ~5.9GB / FP16 ~22GB · mit · 未知 · llama.cpp需自查
证据155 下载
深度求索闪速版,强化智能体与代码场景,附带推测解码模块
适合代码智能体与终端自动化 / 复杂推理与工具编排
短板低资源本地部署(需大内存)
未公开 · MIT · 未知 · llama.cpp需自查
证据163 赞
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索