模型 / Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

多Token预测推理模型,面向编码、数学、DevOps开发者

作者
Jackrong
对位
Qwen3.6-27B 加速替代,同参数量解码速度提升66%
适合
代码生成与系统设计 / 数学推导与复杂逻辑推理
不适合
生产关键任务(社区实验模型)
入选理由
Qwen3.6-27B的GGUF微调版,支持MTP加速生成,可直接用Ollama运行;需自行验证质量。
规模
27B · 128k · 最低 ~16GB · 4-bit(估算)
授权
Apache 2.0 · 可商用
框架
llama.cpp / ollama / LM Studio
血统
LoRA · 基于 Qwen3.6-27B
国内访问
需代理
可信度
下载3.5k+、63赞;30题基准测试吞吐10.46t/s,较原版Qwen3.6-27B快66%

社区实测

社区反馈两极分化:部分用户认可其在实际项目中的表现,但也有用户报告模型容易陷入循环输出

  • MTP机制实现推理加速,官方基准测试中相比Qwen3.6-27B耗时降低26%-43%
  • 有用户反馈在实际编程项目中处理任务优于预期
  • 有用户报告模型在测试中不到20分钟即陷入循环,输出重复内容
  • 社区独立评测数据有限,缺乏大规模验证

截至 2026-07-19

本形态 ~16GB 4-bit · 国内 需代理 · 3,532 下载

快速上手

llama.cpp server -m qwopus3.6-27b-v2-mtp.Q4_K_M.gguf -ngl 99

本形态源 ↗

下载动量

30天下载 115.3k → 91k · likes +44

观测时间线

模型家族

查看全部家族 →