PP-OCRv6_medium_det (PaddlePaddle)
轻量级多语言文本检测模型,48语种,服务端/边缘可用
仅 safetensors · 无 pickle 加载风险
社区实测
PP-OCRv6 在轻量多语言 OCR 场景口碑积极,但 PaddlePaddle 框架的安装体验仍是普遍痛点。
- 提供 1.5M 到 34.5M 参数的多尺寸模型,覆盖端侧到服务器部署
- 50 种语言统一识别,无需切换模型
- 表格等版面结构保持较好,适合后续结构化提取
- 相比 v5 检测精度提升 4.9%、识别精度提升 5.1%
- OpenVINO 下 CPU 推理最高快 5.2 倍
- 新增 PCB、CAD 图纸、数码管、点阵文字等垂直场景支持
- PaddlePaddle 安装过程繁琐,CUDA 版本兼容性要求严格,上手门槛高
来源
PP-OCRv6 is officially released ! : r/LocalLLaMA - Reddit[R] Struggle with PaddlePaddle OCR Vision Language installation
截至 2026-06-19
快速上手
python -c 'from paddleocr import TextDetection; TextDetection(model_name="PP-OCRv6_medium_det", engine="transformers").predict("image.png")' (需 paddleocr 库)