Paddleocr Doc Parsing

Document parsing and OCR using PaddleOCR. Extract text, tables, and structured data from PDFs and images (JPG, PNG, BMP, TIFF). Supports 110+ languages and outputs Markdown format preserving document layout. Use when processing documents for data extraction, invoice parsing, form recognition, or converting scanned documents to structured text. Requires PADDLEOCR_API_URL and PADDLEOCR_ACCESS_TOKEN environment variables.

aresbit Updated

File contents

aresbit/matebot2tg/tree/main/skills/paddleocr-doc-parsing commit 6c09d737ba

Frequently asked questions

npx skillmds@latest add aresbit/paddleocr-doc-parsing