# Webgrab

> Webgrab Skill

- Skill: `futurediffusion/webgrab` (Agent Skill, multi-file: 3 files)
- Install (CLI): `npx skillmds@latest add futurediffusion/webgrab`
- Raw SKILL.md: https://api.skillmd.com/api/skills/futurediffusion/webgrab/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: futurediffusion (https://skillmd.com/u/futurediffusion)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/futurediffusion/webgrab

---

# Webgrab Skill

## Propósito
Obtener páginas web para análisis offline. Soporta HTML plano,
extracción de links, y descarga de recursos estáticos.

## Archivos
- `fetch_page.py` - Script principal de obtención

## Uso

### fetch_page.py
```bash
python SKILLS/webgrab/fetch_page.py <url> [--output <path>] [--links|--text]
```
- `<url>`: URL a obtener (required)
- `--output <path>`: Guardar contenido en archivo
- `--links`: Extraer solo links
- `--text`: Extraer solo texto (strip HTML)

## Output ejemplo
```
URL: https://example.com
STATUS: 200
SIZE: 15,234 bytes
OUTPUT: /path/to/saved/page.html
LINKS: 47 found
```

## Dependencias
- requests (HTTP library)
- beautifulsoup4 (para parsing HTML, opcional)

## Limitaciones
- No ejecuta JavaScript (server-side rendering only)
- No sigue redirects automáticamente
- Timeout de 30 segundos por defecto

## Loggers
- Los URLs visitados se registran en `LOGS/webgrab_<timestamp>.log`
