模型 / Ternary-Bonsai-27B (Prism ML)

Ternary-Bonsai-27B (Prism ML)

三元权重 27B 推理模型,笔记本本地运行

作者 prism-ml

~7.3GB ternary许可 可商用任务 文本生成最近核对 2026-07-22
格式
ternary
文件
~6.3GB
运行内存
~7.3GB–9.5GB
运行时
OLLAMA
下载
23

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/prism-ml/Ternary-Bonsai-27B-gguf

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
可在笔记本上以7.2GB运行27B级别模型,保留95%性能,三进制权重新范式,适合本地离线部署。
对位
对位 Qwen3.6-27B IQ2_XXS 等 2-bit 量化
适合
笔记本端侧推理 27B 模型 / 长上下文 (262K) 离线分析
不适合
手机直接部署

独立证据与社区反馈

3 个独立来源最近验证 2026-07-22

能跑、能完成简单任务,但指令遵循的精细度不如同尺寸传统量化模型,不适合对可靠性要求高的自动化流程。

  • 27B 级模型可在 16GB 消费级显卡上完整加载运行
  • 工具调用/JSON 输出稳定,不会因格式错误或参数缺失随机失败
  • 数学与编程能力在同尺寸模型中表现突出,超过 Gemma 4 12B
  • 指令遵循缺乏精细度,不能稳定按预设流程(如自动加载指定 skill)执行
  • 综合实用表现(生产力助理、知识库管理)不如同配置下的其他量化模型(Qwen 3.6 27B Q2_K_XL、Gemma 4 12B QAT)
  • Agentic coding 场景表现不佳
  • 视觉任务能力明显弱于同级替代方案

可信度80.49 平均分在 15 项思考基准上,保留 FP16 的 95%,部署仅 7.2GB

完整规格

规模
27B · 262K · 下载 ~6.3GB · 显存最低 ~7.3GB · 推荐 ~9.5GB · ternary(估算)
授权
Apache-2.0 · 可商用
框架
llama.cpp / mlx
血统
量化自 Qwen3.6-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 23 → 432.2k

观测时间线

模型家族

查看全部家族 →