PaddleOCR 是轻量级 OCR 工具包,能把 PDF 和图片文档转为结构化数据,衔接图像/PDF 与 LLM。支持 100 多种语言,覆盖中文 OCR、文档解析、PDF 转 Markdown、关键信息抽取和 RAG 等方向,适合需要文档处理的开发者。
Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages.
| 热度动量 | 25% | 10.0 | |
| 开发活跃 | 25% | 6.6 | |
| 社区响应 | 15% | 10.0 | |
| 文档质量 | 15% | 2.5 | |
| 发布节奏 | 10% | 0.0 | |
| 风险控制 | 10% | 10.0 |
评分由 公开的焚评公式 程序计算,数据来自 GitHub API,最近重算于 2 小时前。