Mellum2-12B-A2.5B-Instruct (JetBrains)
直接回答的指令模型,用于交互聊天、代码和工具调用
仓库标识JetBrains/Mellum2-12B-A2.5B-Instruct
显存未知许可 可商用任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- VLLM
- 下载
- 1,418
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve JetBrains/Mellum2-12B-A2.5B-Instruct --max-model-len 131072 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
MoE 架构(12B 总参、2.5B 激活)带来低延迟高吞吐,适合代码生成与路由提取等工程任务,但推理能力弱,且 Ollama 暂不支持。
- 低延迟、高吞吐推理,适合多模型流水线中的路由、Q&A 与子代理任务
- 结构化 JSON 输出,适合路由与信息提取场景
- Apache 2.0 开源且从头训练,支持 128K 上下文与工具调用
- Ollama 尚不支持,Modelfile 加载报 unknown model architecture 'mellum'
- 不是推理模型,遇到 bat-and-ball 类逻辑题会跑偏,视觉生成类任务输出错误
- 代码能力官方对标约 Qwen 3.5 9B 级别,并非顶尖
- 独立评测JetBrains Mellum2 is FAST — but Ollama Can't Run It (Yet)
- 独立评测Mellum2 Goes Open Source: A Fast Model for AI Workflows
- 社区实测Mellum 2 12B A2.5B : r/LocalLLaMA
- 独立评测JetBrains Releases Mellum2: A 12B MoE Model for Fast, Specialized Tasks in Multi-Model AI Pipelines - MarkTechPost
可信度1418下载,48赞;LiveCodeBench v6 37.2%,EvalPlus 78.4%,BFCL v4 44.2%
完整规格
下载动量
30天下载 2.6k → 2.2k · likes +2