网页正文提取指南 (Web Page Extractor)
抓取外部技术博客、新闻或文档,提取干净正文。
执行抓取
node scripts/fetch_and_clean.mjs "https://example.com"
网页正文智能提纯与清洗工具。抓取网页并剔除 HTML 标签、脚本与样式,输出高信息密度的 Markdown。
npx skillmds@latest add 2428424081cn/web-page-extractor 抓取外部技术博客、新闻或文档,提取干净正文。
node scripts/fetch_and_clean.mjs "https://example.com"
2428424081cn/Skill-mcp/tree/main/skills/web/web-page-extractor commit 18bb5a7114