模型 / Qwopus3.5-9B-Coder-MTP (Jackrong)

Qwopus3.5-9B-Coder-MTP (Jackrong)

9B多令牌预测代码模型,GGUF量化,面向代码推理

作者 Jackrong

仓库标识Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF

显存未知许可 可商用任务 智能体最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
OLLAMA
下载
6,680

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF:Q4_K_M

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
GGUF格式可直接部署;MTP提升速度与准确率,属同系列微调。
对位
对位 Qwen2.5-Coder-7B,强调MTP推理加速
适合
本地代码生成与补全 / 高吞吐 Agent 代码推理
不适合
长上下文推理或非量化高精度需求

独立证据与社区反馈

4 个独立来源最近验证 2026-08-09

作为本地小尺寸代码模型口碑不错:社区有帖子称 Qwopus3.5 V3 对本地 LLM 场景很棒,有用户实测 9B 对比 Qwen 3.5 9B 明显占优;不过同场对比中也被 Gemma 4 E4B 超过。

  • 本地(9B 级)可跑的代码模型需求,社区评价 Qwopus3.5 V3 'awsome for a local llm'。
  • 同尺寸基线对比更强:有用户实测 qwopus 9B 对比 Qwen 3.5 9B 'wins hands down'。
  • 自带 MTP 的 GGUF 下载后可直接加载运行,避开普通 GGUF 加载报错的问题。
  • 同场对比被更新的小模型反超:有评论称 Gemma 4 E4B 评分高于 Qwopus 9B。
  • MTP 相关认知门槛:社区讨论中有用户不清楚模型是否内置 MTP、以为需要自行转换,且普通 GGUF 加载会报错,需选对专门版本。

可信度下载量6680,点赞51;基于Qwen3.5-9B,MTP实测吞吐+35.8%

完整规格

规模
9B · 128k · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
llama.cpp / ollama / llama-cpp-python
血统
LoRA · 基于 Qwopus3.5-9B-v3.5
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 328.2k → 319.2k · likes +3

观测时间线