# PDF

> Process and extract content from PDF files

- Skill: `lwmxiaobei/pdf` (Agent Skill)
- Install (CLI): `npx skillmds@latest add lwmxiaobei/pdf`
- Raw SKILL.md: https://api.skillmd.com/api/skills/lwmxiaobei/pdf/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Docs & Writing
- Author: lwmxiaobei (https://skillmd.com/u/lwmxiaobei)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/lwmxiaobei/pdf

---


# PDF Processing

To work with PDF files:

1. Use `bash` to check if `pdftotext` is available: `which pdftotext`
2. If not installed, suggest: `brew install poppler` (macOS) or `apt install poppler-utils` (Linux)
3. Extract text: `pdftotext input.pdf -` (outputs to stdout)
4. For structured extraction: `pdftotext -layout input.pdf -`
5. For page-specific extraction: `pdftotext -f 1 -l 5 input.pdf -` (pages 1-5)

For PDF metadata: `pdfinfo input.pdf`
For PDF to images: `pdftoppm -png input.pdf output_prefix`

