模型 / 归档 / 2026-08-24

本期 (6)

27B

Qwen3.8-27B 的投机解码草案模型,需搭配目标模型使用

适合降低 Qwen3.8-27B 生成延迟 / 提升批量推理吞吐

短板独立运行

Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查

证据26k 下载 / 84 赞

1.9B

为 Qwen3.8-27B 提供投机解码加速的草案模型

适合加速 Qwen3.8-27B 推理 / 高并发低延迟文本生成

短板不可独立作为语言模型使用

Q4 ~1.3GB / FP16 ~4.6GB · apache-2.0 · 128k · vllm需自查

证据50.8k 下载 / 211 赞

27B

2-bit 量化 27B 模型,24GB 显卡 64k 上下文

适合消费级显卡 (24GB) 运行 27B 模型 / 代码生成、推理、对话

短板多模态 (视觉) 任务

Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 128k · SGLang (escha_runtime)需自查

证据1892 下载 / 120 赞

0.17B

0.17B 零样本语音克隆,中英为主多语种 TTS

适合边缘设备零样本语音克隆 / 中英为主多语种语音合成

短板高保真多语种或长音频生成

Q4 ~0.1GB / FP16 ~0.4GB · Audio8 Community License v1.0 · 2048 · transformers需自查

证据1093 下载 / 126 赞

27B

无审查 Qwen3.8-27B 动态量化 GGUF,本地推理

适合免审查文本生成,支持长上下文检索 / 本地 24GB 显卡运行 262k 上下文

短板需安全对齐的商业场景

Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 262k · llama.cpp需自查

证据17.3k 下载 / 92 赞

未公开

ComfyUI 角色表生成,多参考图 360° 一致角色

适合多角度一致角色设计 / 角色参考表生成

短板快速生成,视频模型速度慢

未公开 · minimax-h3-community-license (EU/UK/韩国/美国除外) · 未知 · ComfyUI需自查

证据83 赞

← 前一日 2026-08-22 · 后一日 2026-08-25 →