模型 / MiniCPM5-1B-Thinking (OpenBMB)

MiniCPM5-1B-Thinking (OpenBMB)

1B 思考模型,改进编码与指令遵循,适合本地部署

作者 GnLOLot

~0.6GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-22

仅 safetensors · 无 pickle 加载风险

格式
4-bit
文件
~0.6GB
运行内存
~0.6GB–0.8GB
运行时
OLLAMA
下载
3,483

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
1B小模型支持128K上下文和思考模式,提供GGUF可直接本地部署,适合轻量编码和对话任务。
对位
对位 Qwen2.5-1.5B, Llama-3.2-1B
适合
代码生成与调试 / 需要推理的指令遵循
不适合
高难度通用推理

独立证据与社区反馈

3 个独立来源 · 另 1 官方/转载最近验证 2026-07-22

1B模型跑出超越2B的评测成绩,工具调用、代码和推理在同类中最强,标准Llama架构加Apache 2.0开源使部署无门槛,社区反响热烈。

  • 在端侧/资源受限环境下部署具备工具调用、代码生成和推理能力的小模型
  • 同一checkpoint同时支持快速助手(No-Think)和深度推理(Think)两种模式,无需切换模型
  • 标准LlamaForCausalLM架构,Ollama/vLLM/llama.cpp等主流推理框架零配置直接加载
  • INT4量化后仅约0.5GB,可在手机上运行
  • 原生128K长上下文窗口,在1B规模中罕见
  • 1B规模的固有上限,不适合需要前沿模型能力的复杂场景

可信度HuggingFace 3483下载,129赞,基于 MiniCPM5-1B

完整规格

规模
1B · 128k · 下载 ~0.6GB · 显存最低 ~0.6GB · 推荐 ~0.8GB · 4-bit(估算)
授权
Apache-2.0 · 可商用
框架
transformers / llama.cpp / ollama
工具调用
MiniCPM5 XML 格式
血统
微调自 MiniCPM5-1B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 3.5k → 6.2k

观测时间线

模型家族

查看全部家族 →