Document Ocr Processing

OCR pipeline for the Chuuk Dictionary — Tesseract + Google Vision via `OCRProcessor`, large-document handling via `EnhancedOCRProcessor`, structure-aware parsing via `AdvancedDocumentParser`. Use when ingesting scanned dictionary pages, PDFs, or DOCX files, or debugging extraction quality.

findinfinitelabs eb8ce6d 5.5 KB Updated

File contents

findinfinitelabs/chuuk/tree/main/.claude/skills/document-ocr-processing commit eb8ce6de49

Frequently asked questions

npx skillmds@latest add findinfinitelabs/document-ocr-processing