Paddleocr

Comprehensive PaddleOCR document intelligence skill covering OCR text extraction, table detection and QA, layout analysis, document-level reasoning, structured extraction (forms, invoices, IDs, receipts), seal/stamp recognition, handwriting, formulas, multilingual OCR, and PaddleOCR-VL multimodal tasks. Use when extracting text from images or PDFs, parsing tables, understanding document structure, extracting key-value pairs, running document QA, processing financial documents, or doing any image-to-structured-data task.

DrOlu 07b83d7 12 files · 128.0 KB Updated

File contents

DrOlu/agent-skills/tree/main/skills/paddleocr commit 07b83d7646

Frequently asked questions

npx skillmds@latest add drolu/paddleocr