模型 / North-Mini-Code-1.0 (CohereLabs)

North-Mini-Code-1.0 (CohereLabs)

30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务

作者 CohereLabs

仓库标识CohereLabs/North-Mini-Code-1.0

显存未知许可 可商用任务 智能体最近核对 2026-08-05

仅 safetensors · 无 pickle 加载风险

运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
1,784

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve CohereLabs/North-Mini-Code-1.0

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Cohere的30B激活3B MoE代码模型,量化后本地可跑,支持工具调用和256K上下文,需手动编译llama.cpp分支。
对位
对位 Qwen2.5-Coder-7B (7B 全参)
适合
本地代码生成与代理 / 带工具调用的自动化开发
不适合
非代码的通用对话

独立证据与社区反馈

2 个独立来源最近验证 2026-08-05

代码生成质量不错,但 prefill 极慢(22K 上下文下首 token 约 115 秒),且仅在预期 harness 内表现正常

  • 17/17 场景测试全部通过,覆盖代码生成、修 bug、重构、agentic 工具调用与长上下文检索
  • 32GB M1 Pro 上 4-bit 量化可本地运行,推理速度约 30 tok/s,内存占用不超 20.4GB
  • 编码基准分数超过同级别及部分更大参数量的开源模型
  • 22K token 上下文下首 token 延迟约 115 秒,prefill 阶段极慢
  • 在 SWE/OpenCode 等预期 harness 之外表现异常

可信度下载量 11376,Apache-2.0 许可,Cohere 官方发布,附详细本地部署与评测说明

完整规格

规模
30B总 / 3B激活 · 256K · 权重格式未知,无法估算显存
授权
Apache-2.0 · 可商用
框架
transformers / vllm / llama.cpp
工具调用
Cohere command4 格式
血统
量化自 North-Mini-Code-1.0
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 10.5k → 12k · likes +10

在线体验

观测时间线