Qwen3.8-27B 的投机解码草案模型,需搭配目标模型使用
适合降低 Qwen3.8-27B 生成延迟 / 提升批量推理吞吐
短板独立运行
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查
证据26k 下载 / 84 赞
Qwen3.8-27B 的投机解码草案模型,需搭配目标模型使用
适合降低 Qwen3.8-27B 生成延迟 / 提升批量推理吞吐
短板独立运行
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 未知 · llama.cpp需自查
证据26k 下载 / 84 赞
为 Qwen3.8-27B 提供投机解码加速的草案模型
适合加速 Qwen3.8-27B 推理 / 高并发低延迟文本生成
短板不可独立作为语言模型使用
Q4 ~1.3GB / FP16 ~4.6GB · apache-2.0 · 128k · vllm需自查
证据50.8k 下载 / 211 赞
2-bit 量化 27B 模型,24GB 显卡 64k 上下文
适合消费级显卡 (24GB) 运行 27B 模型 / 代码生成、推理、对话
短板多模态 (视觉) 任务
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 128k · SGLang (escha_runtime)需自查
证据1892 下载 / 120 赞
0.17B 零样本语音克隆,中英为主多语种 TTS
适合边缘设备零样本语音克隆 / 中英为主多语种语音合成
短板高保真多语种或长音频生成
Q4 ~0.1GB / FP16 ~0.4GB · Audio8 Community License v1.0 · 2048 · transformers需自查
证据1093 下载 / 126 赞
无审查 Qwen3.8-27B 动态量化 GGUF,本地推理
适合免审查文本生成,支持长上下文检索 / 本地 24GB 显卡运行 262k 上下文
短板需安全对齐的商业场景
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 262k · llama.cpp需自查
证据17.3k 下载 / 92 赞
ComfyUI 角色表生成,多参考图 360° 一致角色
适合多角度一致角色设计 / 角色参考表生成
短板快速生成,视频模型速度慢
未公开 · minimax-h3-community-license (EU/UK/韩国/美国除外) · 未知 · ComfyUI需自查
证据83 赞
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索