PDF Extract

PDF文本提取技能。从PDF中提取文本供LLM处理。当用户说"提取PDF"、"读PDF"、"PDF转文字"时使用。

wike-chi ec3f5b0 3 files · 759 B Updated

File contents

PDF Extract

Skill Graph: 领域 → [[_index-meta|系统元技能领域]]

Extract text from PDF files for LLM processing. Uses pdftotext from the poppler-utils package to convert PDF documents into plain text.

Commands

# Extract all text from a PDF
pdf-extract "document.pdf"

# Extract text from specific pages
pdf-extract "document.pdf" --pages 1-5

Install

sudo dnf install poppler-utils

wike-chi/acquisition-agent/tree/main/skills/pdf-extract commit ec3f5b016c

Frequently asked questions

npx skillmds@latest add wike-chi/pdf-extract