云图AI云图AI
P

PaddleOCR

Apache-2.0Python

Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages.

87kFork 11k更新于 2026-07-31

软件介绍

PaddleOCR 是一款领先的 OCR 工具包,可将 PDF 和图像文档转换为结构化的、可供 LLM 使用的数据(JSON/Markdown)。拥有 70k+ Stars,被 Dify、RAGFlow、Cherry Studio 等顶级项目信赖,是构建智能 RAG 和 Agent 应用的基石。

核心功能

智能文档解析:支持 PaddleOCR-VL-1.6 和 PP-StructureV3,输出 Markdown/JSON 格式,准确率高达 96.3%。
通用文字识别:支持 100+ 语言,PP-OCRv6 单模型覆盖 50 种语言,检测和识别精度大幅提升。
开发者生态:深度集成 Dify、RAGFlow 等 AI Agent 平台,支持一键部署到多种硬件。
高效推理:CPU 推理速度提升 5.2 倍,支持 GPU、XPU、NPU 等多种后端。

适用场景

将扫描的 PDF 文档转换为可编辑的 Markdown 或 JSON,用于 RAG 系统。从身份证、发票、表格等图像中提取结构化信息。多语言场景下的文字识别,如中英文混合文档、日文、韩文等。构建智能文档处理流水线,用于数据标注、知识库构建等。

Docker 部署

docker pull paddlepaddle/paddleocr:latest

FAQ

PaddleOCR 支持哪些语言?

PaddleOCR 支持 100+ 种语言,其中 PP-OCRv6 单模型覆盖 50 种语言(中文、英文、日文及 46 种拉丁语系语言),PaddleOCR-VL 系列支持 109 种语言。

如何快速开始使用 PaddleOCR?

可以访问官方网站在线体验(https://www.paddleocr.com),或参考文档进行本地部署:https://www.paddleocr.ai/latest/en/version3.x/pipeline_usage/OCR.html