Extract schema.org, Open Graph, and JSON-LD metadata from web pages for indexing

Uses extruct to pull machine-readable metadata from raw HTML so an agent can classify, deduplicate, or enrich pages without brittle full-page parsing. It is best for metadata harvesting workflows, not for crawling an entire site or rendering JavaScript-heavy pages.

agentskillexchange Updated 28 repo stars

File contents

agentskillexchange/skills/tree/main/skills/extract-schema-org-open-graph-and-json-ld-metadata-from-web-pages-for-indexing commit c9dc51b939

Frequently asked questions

npx skillmds@latest add agentskillexchange/extract-schema-org-open-graph-and-json-ld-metadata-from-web-