# Priority Queues

> Colas separadas por prioridad con workers dedicados para garantizar SLO de latencia

- Skill: `davidcastagnetoa/priority-queues` (Agent Skill, multi-file: 2 files)
- Install (CLI): `npx skillmds@latest add davidcastagnetoa/priority-queues`
- Raw SKILL.md: https://api.skillmd.com/api/skills/davidcastagnetoa/priority-queues/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: davidcastagnetoa (https://skillmd.com/u/davidcastagnetoa)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/davidcastagnetoa/priority-queues

---


# priority_queues

Colas de prioridad separadas garantizan que las tareas críticas de baja latencia (liveness) no compiten por workers con tareas menos urgentes (auditoría, análisis batch).

## When to use

Usar para segregar todas las tareas del pipeline KYC por nivel de urgencia.

## Instructions

1. Definir 4 colas en la configuración de Celery:
   - `realtime`: liveness, captura (SLO < 1s).
   - `gpu`: face_match, deepfake detection (SLO < 2s).
   - `cpu`: OCR, document processing (SLO < 3s).
   - `async`: auditoría, notificaciones, analytics (SLO < 30s).
2. Asignar tareas a colas con el decorador: `@app.task(queue='gpu')`.
3. Arrancar workers dedicados: `celery worker -Q realtime --concurrency=4 -P prefork`.
4. Asignar más workers a colas críticas.
5. Configurar `task_routes` en la configuración de Celery para enrutamiento automático.

## Notes

- Workers de cola GPU deben tener acceso a la GPU: `-P solo --concurrency=1` (un proceso por GPU).
- Monitorizar la profundidad de cada cola en Flower y Grafana.

