模型 / Mellum2-12B-A2.5B-Instruct (JetBrains)

Mellum2-12B-A2.5B-Instruct (JetBrains)

直接回答的指令模型,用于交互聊天、代码和工具调用

作者 JetBrains

仓库标识JetBrains/Mellum2-12B-A2.5B-Instruct

显存未知许可 可商用任务 文本生成最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
1,418

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve JetBrains/Mellum2-12B-A2.5B-Instruct --max-model-len 131072

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
JetBrains的MoE模型,Apache-2.0许可,上下文131k,需自行部署。
对位
对位 Ministral 3 14B、Qwen3.5-9B 等指令模型
适合
交互式聊天与代码辅助 / 工具调用与指令跟随
不适合
需显式推理的多步代理流

独立证据与社区反馈

4 个独立来源最近验证 2026-08-05

MoE 架构(12B 总参、2.5B 激活)带来低延迟高吞吐,适合代码生成与路由提取等工程任务,但推理能力弱,且 Ollama 暂不支持。

  • 低延迟、高吞吐推理,适合多模型流水线中的路由、Q&A 与子代理任务
  • 结构化 JSON 输出,适合路由与信息提取场景
  • Apache 2.0 开源且从头训练,支持 128K 上下文与工具调用
  • Ollama 尚不支持,Modelfile 加载报 unknown model architecture 'mellum'
  • 不是推理模型,遇到 bat-and-ball 类逻辑题会跑偏,视觉生成类任务输出错误
  • 代码能力官方对标约 Qwen 3.5 9B 级别,并非顶尖

可信度1418下载,48赞;LiveCodeBench v6 37.2%,EvalPlus 78.4%,BFCL v4 44.2%

完整规格

规模
12B (2.5B active) · 131k · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
vllm / transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2.6k → 2.2k · likes +2

观测时间线