PaddleOCR
活跃简介
PaddleOCR 是百度开源的多语言 OCR 与文档智能工具箱,支持 80+ 语言与 PP-Structure 版面分析。
核心特性
- 多语言识别 — 内置 80+ 主流语言模型,简体中文、繁体、英文、阿拉伯文等
- PP-Structure 版面分析 — 文本块、表格、图、公式自动分类与定位
- PP-OCRv4 高精度 — 业界领先的检测 + 识别端到端精度
- PP-StructureV2 — 表格识别 (TableMaster)、关键信息抽取 (KIE) 一体化
- PaddleInference / ONNX 推理 — 同时支持飞桨原生与 ONNX 跨平台部署
- 丰富预训练库 — 检测、识别、方向分类、版面分析、公式识别一应俱全
适用场景
💡 为 Agent 文档场景提供高精度 OCR 与版面解析能力
💡 构建 RAG 系统的 PDF/图片预处理流水线
💡 在合同、发票、证件等场景进行表格与关键信息抽取
💡 多语言文档数字化与跨语言检索
优势与不足
✅ 优势
- • 活跃维护,近期持续更新
- • 社区热度高(87.7k stars)
- • 开源许可证友好(Apache-2.0)
- • Issue 响应及时,积压少
分类
快速开始
pip install paddleocr
paddleocr --image_dir ./doc.jpg --use_angle_cls true --lang ch