模型 / 归档 / 2026-05-18

本期 (12)

27B

解禁版Qwen3.6-27B量化模型,为创意写作与代码而生

适合创意写作与角色扮演 / 图像理解与代码生成

短板需严格内容过滤的场景

27B · apache-2.0 · 256k · llama.cpp可商用

证据357.5k 下载 / 183 赞 / 6 个社区来源

26B

无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理

适合本地苹果硅无审查对话 / 快速编程与韩语任务

短板需严格内容审核的场景

26B · gemma · 未知 · llama.cpp限制商用

证据267.4k 下载 / 624 赞 / 9 个社区来源

9B

像素空间文生图模型,基于AsymFlow,适合文字渲染与细节生成

适合高质量文本渲染的生成 / 需要精细细节的艺术创作

短板低显存设备或实时推理

9B · flux-non-commercial-license · N/A · diffusers

证据1608 下载 / 49 赞 / 4 个社区来源

1.74B

多模态嵌入模型,支持文本/图像/视频/音频

适合多模态检索与RAG / 跨模态零样本分类与聚类

短板仅需文本嵌入的轻量场景

Q4 ~1.1GB / FP16 ~3.9GB · cc-by-nc-4.0 · 32768 · transformers不可商用

证据28.9k 下载 / 49 赞 / 4 个社区来源

35B (3B 激活 MoE)

Qwen3.6 MoE GGUF 量化版,用于本地代理编程与多模态推理

适合Agentic 编码与 SWE-bench 任务 / 多模态视觉理解与文档分析

短板不适合微调及高精度科学计算

35B (3B 激活 MoE) · apache-2.0 · 262k (可扩展至 1M) · llama.cpp可商用

证据2569.1k 下载 / 1052 赞 / 10 个社区来源

9B

面向Agent编码与工具调用的9B视觉推理模型

适合Agent编码与工具调用 / 代码调试与逻辑推理

短板通用对话或非编程任务

9B · apache-2.0 · 32k · llama.cpp可商用

证据6462 下载 / 89 赞 / 3 个社区来源

500M

日语TTS,表情符号控制风格,零样本克隆

适合零样本日语语音克隆 / 表情符号驱动风格与音效控制

短板非日语文本或需精确汉字阅读

Q4 ~0.3GB / FP16 ~1.2GB · MIT · 未知 · pytorch可商用

证据67 赞 / 4 个社区来源

4B

无审查的Gemma 4多模态模型,适合内容生成开发者

适合无审查的多模态聊天应用 / 本地图像/音频内容生成

短板需安全合规的生产环境

4B · Gemma · 131k · llama.cpp限制商用

证据796.4k 下载 / 607 赞 / 9 个社区来源

26B (25.2B total, 3.8B active)

Gemma4 无审查多模态 MoE,面向创意写作与角色扮演

适合创意写作与角色扮演 / 多模态图片-文本对话

短板高复杂度 agentic 编程任务

26B (25.2B total, 3.8B active) · Apache-2.0 · 256K · llama.cpp可商用

证据40.3k 下载 / 53 赞 / 7 个社区来源

27B

Qwen3.6-27B GGUF量化版,面向本地部署与边缘推理

适合本地代码智能体与工具调用 / 长上下文文档分析及问答

短板依赖全精度浮点的科研场景

27B · Apache-2.0 · 262K · llama.cpp可商用

证据1845.9k 下载 / 692 赞 / 12 个社区来源

27B

Qwen3.6-27B的MTP量化版,推理速度1.5-2倍提升

适合代码编写与Agent任务 / 本地多模态推理与节省显存

短板低内存或无GPU环境

27B · Apache-2.0 · 262k (可扩展至1M) · llama.cpp可商用

证据268.3k 下载 / 254 赞 / 10 个社区来源

未公开

LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI

适合图像首帧到视频生成 / 对话与动作驱动的视频生成

短板高分辨率或长片段生成

未公开 · unknown · 未知 · ComfyUI

证据71.5k 下载 / 65 赞 / 4 个社区来源

← 前一日 2026-05-16 · 后一日 2026-05-19 →