此页是 2026-08-06 的观测快照,查看该模型当前信息 → /m/mannix-ita__qwen36-27b-omnimerge-v4-mtp-gguf/

归档 / 2026-08-06 / Qwen3.6-27B Omnimerge v4 MTP (ManniX-ITA)

Qwen3.6-27B Omnimerge v4 MTP (ManniX-ITA)

带 MTP 自推测解码的 GGUF 量化版,加速本地推理

入选理由
Qwen3.6-27B 合并模型的 GGUF,保留 MTP 头,llama.cpp 上可自推测解码,吞吐约2倍。适合 24GB 显存、用最新 llama.cpp 的本地推理用户。
对位
对位 Qwen3.6-27B 基座模型
适合
代码生成 (HumanEval 83.5%) / 长文本 CoT 推理加速 (2x)
不适合
视觉多模态任务 (MTP 未验证)
规模
27B · 128k · Q4 ~18GB / FP16 ~65GB
授权
apache-2.0 · 需自查
框架
llama.cpp / ollama
血统
量化自 Qwen3.6-27B-Omnimerge-v4
可信度
4600+ 下载,HumanEval 83.54% 与基座一致,MTP 推理吞吐 2x

快速上手示例

llama-server -hf ManniX-ITA/Qwen3.6-27B-Omnimerge-v4-MTP-GGUF -m Qwen3.6-27B-Omnimerge-v4-Q6_K.gguf --spec-type draft-mtp --spec-draft-n-max 3 -ngl 99 -c 16384

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-06)

作者
ManniX-ITA
任务类型
unknown
推理库
未指定
下载
4,608
点赞
9
许可证
apache-2.0
标签
gguf, imatrix, quantized, mtp, speculative-decoding, base_model:ManniX-ITA/Qwen3.6-27B-Omnimerge-v4, base_model:quantized:ManniX-ITA/Qwen3.6-27B-Omnimerge-v4, license:apache-2.0, endpoints_compatible, region:us, conversational

探索

源链接