Mellum2-12B-A2.5B-Thinking (JetBrains)
思考型助手,在<think>块中输出推理链后给出最终答案
仓库标识JetBrains/Mellum2-12B-A2.5B-Thinking
显存未知许可 可商用任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- VLLM
- 下载
- 799
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve JetBrains/Mellum2-12B-A2.5B-Thinking --max-model-len 131072 --reasoning-parser qwen3 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
低资源部署场景的编码能力超出预期,思考版显著优于指令版,是单 GPU 可跑的 MoE 模型里综合表现很扎实的选择。
- 单 GPU 即可运行,12B 总参数仅 2.5B 激活,低显存环境下也能部署
- Thinking 版基准分数显著优于 Instruct 版
- 支持 FIM(填充中间代码),适合代码补全场景
- Agent 工作流中提示预填充(Prompt Ingest)速度较快,适合密集读取代码库的代理任务
- 部分社区用户希望有 15-20B 的更大尺寸版本,当前 12B 规模在某些场景下仍有局限
- 同一模型无法同时擅长编码和知识库处理,需按具体场景分别选型
- 社区实测Mellum 2 12B A2.5B : r/LocalLLaMA
- 独立评测JetBrains/Mellum2-12B-A2.5B-Thinking | vLLM Recipes
- 独立评测Mellum2 Goes Open Source: A Fast Model for AI Workflows - The JetBrains Blog
- 社区实测Jetbrains Mellum 2: a really good and performant model : r/LocalLLaMA
- 独立评测Medium
可信度在LiveCodeBench v6代码评测中pass@1达69.9%,在AIME 2025+2026数学评测均分58.4%
完整规格
下载动量
30天下载 2.3k → 2.3k · likes +5