模型 / 归档 / 2026-07-10

本期 (4)

555M

流式自回归 TTS,面向实时对话与语音代理

适合实时语音代理 / 流式对话与配音

短板精确声纹匹配任务

Q4 ~0.4GB / FP16 ~1.3GB · Apache 2.0 (codec: NVIDIA Open Model License) · 未知 · vllm需自查

证据1468 下载 / 62 赞

27B

视觉语言模型,思考令牌减半,GGUF量化,适合本地运行

适合需要思维链但希望节省Token成本 / 本地视觉问答与推理部署

短板长链深度推理,精度可能略降

Q4 ~18GB / FP16 ~65GB · unknown · 未知 · llama.cpp需自查

证据298.8k 下载 / 57 赞

1B

1B 思维链模型 GGUF 量化,本地轻量代码与指令任务

适合代码生成与调试 / 基于思维链的长上下文指令跟随

短板不适合高精度世界知识任务

Q4 ~0.7GB / FP16 ~2.4GB · apache-2.0 · 128k · llama.cpp需自查

证据2239 下载 / 140 赞 / 3 个社区来源

27B

Claude Opus推理蒸馏并反审查的27B模型GGUF版

适合复杂推理与多步逻辑 / 创意写作与无过滤对话

短板安全合规的生产环境

Q4 ~18GB / FP16 ~65GB · apache-2.0 · 256K · llama.cpp需自查

证据132 下载

← 前一日 2026-07-09 · 后一日 2026-07-11 →