Web Page Extractor

网页正文智能提纯与清洗工具。抓取网页并剔除 HTML 标签、脚本与样式,输出高信息密度的 Markdown。

2428424081cn Updated

File contents

网页正文提取指南 (Web Page Extractor)

抓取外部技术博客、新闻或文档,提取干净正文。

执行抓取

node scripts/fetch_and_clean.mjs "https://example.com"

2428424081cn/Skill-mcp/tree/main/skills/web/web-page-extractor commit 18bb5a7114

Frequently asked questions

npx skillmds@latest add 2428424081cn/web-page-extractor