模型 / Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)

多Token预测推理模型,面向编码、数学、DevOps开发者

作者 Jackrong

~16GB 4-bit许可 可商用任务 智能体最近核对 2026-07-22
格式
4-bit
文件
~14GB
运行内存
~16GB–21GB
运行时
llama.cpp
下载
3,532

Hugging Face 源仓库 ↗

适合与不适合

入选理由
Qwen3.6-27B的GGUF微调版,支持MTP加速生成,可直接用Ollama运行;需自行验证质量。
对位
Qwen3.6-27B 加速替代,同参数量解码速度提升66%
适合
代码生成与系统设计 / 数学推导与复杂逻辑推理
不适合
生产关键任务(社区实验模型)

独立证据与社区反馈

2 个独立来源 · 另 2 官方/转载最近验证 2026-07-22

在 Qwen3.6-27B 的 Q4 量化版本中综合编码评测排名第一,MTP 加速约 2x 得到社区实测验证

  • Qwen3.6-27B 的 Q4 量化编码场景的性能优化
  • MTP 投机解码使推理速度提升约 2x,可直接在 llama.cpp 中使用
  • SWE-bench Verified 在 no-thinking 模式下达到 67% 的解决率
  • Q8 量化在 llama.cpp 中会崩溃
  • 缺少 MLX 和 NVFP4 量化版本
  • 社区仍在进行参数调优,实际编码流程中的集成测试尚未完成

可信度下载3.5k+、63赞;30题基准测试吞吐10.46t/s,较原版Qwen3.6-27B快66%

完整规格

规模
27B · 128k · 下载 ~14GB · 显存最低 ~16GB · 推荐 ~21GB · 4-bit(估算)
授权
Apache 2.0 · 可商用
框架
llama.cpp / ollama / LM Studio
血统
LoRA · 基于 Qwen3.6-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 111.4k → 87.7k · likes +38

观测时间线

模型家族

查看全部家族 →