LiteParse — parser de documentos LOCAL (v2)
⚠️ Corrección 2026-09-05 (auditoría): la v1 usaba
from liteparse import DocumentParserconmodel='gpt-4o'yschema=...— no existe. LiteParse (v2) es un parser local (PDFium + Tesseract OCR) con APILiteParse().parse(...), sin LLM ni cloud ni output CSV.
Repo: https://github.com/run-llama/liteparse (Rust, ~12K⭐).
When to Use
- Cuando pidas parsear documentos a Markdown/JSON/texto en local, sin depender de un LLM/cloud. Parser de PDF con OCR.
Uso (API real)
from liteparse import LiteParse
parser = LiteParse()
result = parser.parse("documento.pdf") # parser local (PDFium + Tesseract OCR)
# formatos de salida: json | text | markdown (NO csv)
También vía CLI (crate Rust): cargo install liteparse.
Pitfalls
- NO
DocumentParser(model="gpt-4o", schema=...)— esa clase/params no existen. - Es un parser local, explícitamente "sin features LLM propietarias ni dependencias cloud".
- Salidas: json / text / markdown; no hay CSV.
Verificación
LiteParse().parse(doc.pdf)→ comprobar que produce markdown/texto con bounding boxes correctos.