PDF Extract

Extract text from PDF files for LLM processing

dvcrn Updated 32 repo stars

File contents

PDF Extract

Extract text from PDF files for LLM processing. Uses pdftotext from the poppler-utils package to convert PDF documents into plain text.

Commands

# Extract all text from a PDF
pdf-extract "document.pdf"

# Extract text from specific pages
pdf-extract "document.pdf" --pages 1-5

Install

sudo dnf install poppler-utils

dvcrn/openclaw-skills-marketplace/tree/main/plugins/xejrax--pdf-extract/skills/pdf-extract commit d065cf1e26

Frequently asked questions

npx skillmds@latest add dvcrn/pdf-extract