PDF Processing

Extract text and tables from PDFs; use when PDFs, forms, or document extraction are mentioned.

majiayu000 Updated 567 repo stars

File contents

PDF Processing

  • Use pdfplumber to extract text.
  • Install pdfplumber with pip install pdfplumber.
  • Extract text per page:
    import pdfplumber
    
    with pdfplumber.open("input.pdf") as pdf:
        text = "\n".join(page.extract_text() or "" for page in pdf.pages)
    
  • For form filling, pair with your form template or validation steps.

majiayu000/claude-skill-registry-data/tree/main/documents/pdf-processing commit 326076950d

Frequently asked questions

npx skillmds@latest add majiayu000/pdf-processing-4