PP-OCRv6_medium_det (PaddlePaddle)
轻量级多语言文本检测模型,48语种,服务端/边缘可用
~0.1GB 4-bit许可 可商用任务 视觉理解最近核对 2026-07-22
适合与不适合
独立证据与社区反馈
检测精度远超同类模型甚至百亿级 VLM,但安装和英文文档体验是公认的痛点
- 高精度文字检测,覆盖手写、印刷、旋转、弯曲、艺术字等多种场景
- 在文字检测上大幅超越 Gemini-3.1-Pro 等主流 VLM(86.2% vs 46.8%)
- 单一模型支持中、英、日及 46 种拉丁语系共 50 种语言,无需切换模型
- 提供 medium/small/tiny 三档模型,支持从服务器到边缘端的轻量部署
- 端到端 CPU 推理速度提升 5.2 倍
- 安装过程非常折腾,英文文档质量差,社区反馈其为「见过最难安装的开源软件」
- 基准/排行PP-OCRv6: From 1.5M to 34.5M Parameters, Surpassing Billion-Scale VLMs on OCR Tasks
- 社区实测[R] Struggle with PaddlePaddle OCR Vision Language ...
- 官方/厂商PaddlePaddle/PaddleOCR: Turn any PDF or image ...
可信度PP-OCRv6 系列检测 Hmean 86.2%,15.5M 参数,Apache-2.0,支持48语言
完整规格
下载动量
30天下载 3.9k → 2.9k · likes +23