P
PaddleOCR
PaddlePaddle/PaddleOCR
将任何PDF或图像文档转换为适用于AI的结构化数据。一个强大、轻量级的OCR工具包,弥合了图像/PDF与LLM之间的差距。支持100多种语言。
★87.2kstars
Python
Apache-2.0
更新: 今天
📋 项目速览
点击展开
这是什么?模型领域,基于ai4science和chineseocr的用Python构建、开源工具
作者是谁?由 PaddlePaddle 团队维护,GitHub 87.2K⭐,在 模型 分类 3201 个项目中排名第 6
为什么诞生?随着ai4science和chineseocr在模型中的普及,PaddlePaddle打造了PaddleOCR作为一站式解决方案。
能干什么?核心场景:document-parsing、document-translation、kie
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/PaddlePaddle/PaddleOCR | 官网 https://www.paddleocr.com
🔗 github.com/PaddlePaddle/PaddleOCR | 官网 https://www.paddleocr.com
标签
ai4sciencechineseocrdocument-parsingdocument-translationkieocrpaddleocr-vlpdf-extractor-ragpdf-parserpdf2markdownpp-ocrpp-structurerag