此页是 2026-05-24 的观测快照,查看该模型当前信息 → /m/jackrong__qwopus36-27b-v2-mtp-gguf/

归档 / 2026-05-24 / Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

多Token预测推理模型,面向编码、数学、DevOps开发者

入选理由
Qwen3.6-27B的GGUF微调版,支持MTP加速生成,可直接用Ollama运行;需自行验证质量。
对位
Qwen3.6-27B 加速替代,同参数量解码速度提升66%
适合
代码生成与系统设计 / 数学推导与复杂逻辑推理
不适合
生产关键任务(社区实验模型)
规模
27B · 128k
授权
Apache 2.0 · 可商用
框架
llama.cpp / ollama / LM Studio
血统
LoRA · 基于 Qwen3.6-27B
可信度
下载3.5k+、63赞;30题基准测试吞吐10.46t/s,较原版Qwen3.6-27B快66%

社区实测

编码实测中部分用户反馈优于 Qwen3.6-27B 且无循环问题,推理速度有明确提升,但社区对训练数据来源与实用性存在质疑

  • 编码任务中相比 Qwen3.6-27B 减少了循环问题,在大代码库上表现更好
  • 推理速度相比 Qwen3.6-27B 提升约 2.3 倍,Logic/DevOps/Edge 三项基准耗时降低 26%-44%
  • 有社区用户质疑模型仅在 GSM-8K 和 Claude 思考轨迹上训练,缺乏与基础模型的全面对比评测
  • 部分用户认为该模型缺乏实际使用价值

截至 2026-06-19

快速上手

llama.cpp server -m qwopus3.6-27b-v2-mtp.Q4_K_M.gguf -ngl 99

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   3 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-05-24)

作者
Jackrong
任务类型
text-generation
推理库
transformers
下载
3,532
点赞
63
许可证
Apache 2.0
标签
transformers, gguf, text-generation-inference, unsloth, qwen3_6, reasoning, chain-of-thought, mtp, multi-token-prediction, speculative-decoding, lora, sft, agent, coder, devops, math, science, image, text-generation, en, zh, ko, ru, ja, es, dataset:Jackrong/Claude-opus-4.7-TraceInversion-5000x, dataset:Jackrong/Claude-opus-4.6-TraceInversion-9000x, license:apache-2.0, endpoints_compatible, region:us, conversational

探索

源链接