Ternary Bonsai 27B (prism-ml)
三元2-bit 27B开源模型,笔记本本地运行推理
仓库标识prism-ml/Ternary-Bonsai-27B-mlx-2bit
显存未知许可 可商用任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 运行时
- LLAMA-SERVER
- 下载
- 6
仅 safetensors · 无 pickle 加载风险
快速上手示例
llama-server -hf prism-ml/Ternary-Bonsai-27B-gguf 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
社区认可其压缩效率,让27B模型首次能在消费级设备本地运行,但实际体验上推理质量和CPU速度仍不及传统4bit量化。
- 让27B级模型能在消费级硬件(笔记本/手机)上运行,此前典型Qwen 27B在同级硬件上无法达到可用速度
- 明显优于同量级的2bit量化版本(Q2_XXS)
- 实际质量不如4bit量化(Q4),困惑度显著更高(PPL 13.8 vs 7.3)
- CPU上三元推理尚未优化,速度极低(0.7-0.8 tok/s),目前仅在GPU上有实用价值
- 社区实测Bonsai 27B: A 27B-Class model that runs on a phone
- 社区实测Prism-ML Bonsai Qwen 3.6 27B : r/LocalLLaMA
- 独立评测Announcing Bonsai 27B: The First 27B-Class Model to Run ...
可信度15项基准平均80.49分,MATH-500达99.20,AIME25达90.84
完整规格
下载动量
30天下载 1338.3k → 1047.6k · likes +13