模型 / 归档 / 2026-08-01

本期 (4)

27B

多模态 27B 模型,纯 Q1_0 量化,语言部分仅 3.8 GB

适合低显存本地多模态聊天 / 图片描述与视觉问答

短板复杂文档视觉解析

Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查

证据218 下载 / 3 赞

35B

35B开源语言模型,GGUF格式便于本地部署

适合本地化对话与内容生成 / 代码辅助与文本创作

短板多模态任务或生产关键系统

Q4 ~23GB / FP16 ~84GB · MIT · 未知 · llama.cpp需自查

证据111 下载

9B

LM Studio 提供的 GGUF 量化版,适用本地部署

适合对话生成 / 文本续写

短板高精度知识问答(量化)

Q4 ~5.9GB / FP16 ~22GB · mit · 未知 · llama.cpp需自查

证据155 下载

未公开

深度求索闪速版,强化智能体与代码场景,附带推测解码模块

适合代码智能体与终端自动化 / 复杂推理与工具编排

短板低资源本地部署(需大内存)

未公开 · MIT · 未知 · llama.cpp需自查

证据163 赞

← 前一日 2026-07-31 · 后一日 2026-08-02 →