模型 / Qwopus3.5-9B-Coder-MTP (Jackrong)

Qwopus3.5-9B-Coder-MTP (Jackrong)

9B多令牌预测代码模型,GGUF量化,面向代码推理

作者 Jackrong

~5.4GB 4-bit许可 可商用任务 智能体最近核对 2026-07-22
格式
4-bit
文件
~4.7GB
运行内存
~5.4GB–7GB
运行时
OLLAMA
下载
6,680

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF:Q4_K_M

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
GGUF格式可直接部署;MTP提升速度与准确率,属同系列微调。
对位
对位 Qwen2.5-Coder-7B,强调MTP推理加速
适合
本地代码生成与补全 / 高吞吐 Agent 代码推理
不适合
长上下文推理或非量化高精度需求

独立证据与社区反馈

2 个独立来源 · 另 1 官方/转载最近验证 2026-07-22

有用户反馈该模型在本地 agentic 编排中稳定且智能,MTP 版本在多数基准测试中优于基础版,但社区讨论度不高

  • 本地 agentic 编排
  • MTP 在 DevOps 和数学领域表现优于基础版
  • MTP 版本在边缘场景测试中表现不如基础版
  • 量化质量仍存在社区疑问

可信度下载量6680,点赞51;基于Qwen3.5-9B,MTP实测吞吐+35.8%

完整规格

规模
9B · 128k · 下载 ~4.7GB · 显存最低 ~5.4GB · 推荐 ~7GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
llama.cpp / ollama / llama-cpp-python
血统
LoRA · 基于 Qwopus3.5-9B-v3.5
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 82.3k → 55.1k · likes +14

观测时间线