ThinkingCap-Qwen3.6-27B (bottlecapai)
视觉语言模型,思考令牌减半,GGUF量化,适合本地运行
- 入选理由
- Qwen3.6-27B微调版,推理token减半并保持质量,提供GGUF和视觉支持,适合本地高效部署,无硬性门槛。
- 对位
- 对位 Qwen3.6-27B 原版及同类27B视觉模型
- 适合
- 需要思维链但希望节省Token成本 / 本地视觉问答与推理部署
- 不适合
- 长链深度推理,精度可能略降
- 规模
- 27B · 未知 · Q4 ~18GB / FP16 ~65GB
- 授权
- unknown · 需自查
- 框架
- llama.cpp / ollama
- 血统
- 量化自 ThinkingCap-Qwen3.6-27B
- 可信度
- 近30万次下载,Q4_K_M精度与f16相当,MTP解码速度提升约1.5倍
快速上手示例
llama-server -hf bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:Q4_K_M --mmproj bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:mmproj-ThinkingCap-Qwen3.6-27B-f16.gguf 点击复制
依赖版本和硬件参数请以源仓库说明为准。