Prometheus Node Exporter para recopilar metricas de hardware y sistema operativo (CPU, memoria, disco, red) de cada nodo del cluster donde se ejecuta el pipeline KYC. Permite correlacionar el consumo de recursos con el rendimiento de las verificaciones y detectar cuellos de botella en la infraestructura subyacente.
When to use
Usa esta skill cuando necesites monitorear los recursos fisicos de los nodos que ejecutan el pipeline de verificacion KYC. Pertenece al observability_agent y se aplica cuando hay que diagnosticar problemas de rendimiento, planificar capacidad o correlacionar la degradacion del pipeline con la saturacion de recursos del sistema.
Instructions
Desplegar Node Exporter como DaemonSet en Kubernetes para cubrir todos los nodos:
En los nodos que ejecutan inferencia ML (face_match, liveness), prestar especial atencion a la memoria disponible ya que los modelos ArcFace e InsightFace consumen cantidades significativas de RAM.
Las metricas de disco son criticas porque MinIO almacena temporalmente las imagenes de verificacion; si el disco se satura, todo el pipeline KYC se detiene.
Usar hostNetwork: true es necesario para que Node Exporter acceda a las metricas reales del nodo, pero debe limitarse al namespace de monitoring con NetworkPolicies apropiadas.
1---2name: node-exporter3description: Exportador de metricas de sistema para correlacionar recursos del nodo con rendimiento KYC4---56# node_exporter78Prometheus Node Exporter para recopilar metricas de hardware y sistema operativo (CPU, memoria, disco, red) de cada nodo del cluster donde se ejecuta el pipeline KYC. Permite correlacionar el consumo de recursos con el rendimiento de las verificaciones y detectar cuellos de botella en la infraestructura subyacente.910## When to use1112Usa esta skill cuando necesites monitorear los recursos fisicos de los nodos que ejecutan el pipeline de verificacion KYC. Pertenece al **observability_agent** y se aplica cuando hay que diagnosticar problemas de rendimiento, planificar capacidad o correlacionar la degradacion del pipeline con la saturacion de recursos del sistema.1314## Instructions15161. Desplegar Node Exporter como DaemonSet en Kubernetes para cubrir todos los nodos:17 ```yaml18 # k8s/node-exporter-daemonset.yml19 apiVersion: apps/v120 kind: DaemonSet21 metadata:22 name: node-exporter23 namespace: monitoring24 spec:25 selector:26 matchLabels:27 app: node-exporter28 template:29 metadata:30 labels:31 app: node-exporter32 spec:33 hostNetwork: true34 hostPID: true35 containers:36 - name: node-exporter37 image: prom/node-exporter:v1.8.038 args:39 - '--path.rootfs=/host'40 - '--collector.filesystem.mount-points-exclude=^/(sys|proc|dev|host|etc)($$|/)'41 ports:42 - containerPort: 910043 hostPort: 910044 volumeMounts:45 - name: rootfs46 mountPath: /host47 readOnly: true48 volumes:49 - name: rootfs50 hostPath:51 path: /52 ```53542. Configurar Prometheus para descubrir automaticamente los Node Exporters:55 ```yaml56 scrape_configs:57 - job_name: 'node-exporter'58 kubernetes_sd_configs:59 - role: node60 relabel_configs:61 - source_labels: [__address__]62 regex: '(.*):10250'63 replacement: '${1}:9100'64 target_label: __address__65 - source_labels: [__meta_kubernetes_node_name]66 target_label: node67 ```68693. Definir alertas de saturacion de recursos relevantes para el pipeline KYC:70 ```yaml71 groups:72 - name: node-resources73 rules:74 - alert: NodeHighCPU75 expr: 100 - (avg by(node) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100) > 8576 for: 5m77 labels:78 severity: warning79 annotations:80 summary: "CPU del nodo {{ $labels.node }} al {{ $value }}%"81 - alert: NodeHighMemory82 expr: (1 - node_memory_MemAvailable_bytes / node_memory_MemTotal_bytes) * 100 > 9083 for: 3m84 labels:85 severity: critical86 annotations:87 summary: "Memoria del nodo {{ $labels.node }} al {{ $value }}%"88 ```89904. Monitorear el disco para prevenir problemas con el almacenamiento temporal de imagenes en MinIO:91 ```yaml92 - alert: NodeDiskSpaceLow93 expr: (1 - node_filesystem_avail_bytes{fstype!~"tmpfs|overlay"} / node_filesystem_size_bytes) * 100 > 8094 for: 10m95 labels:96 severity: warning97 annotations:98 summary: "Disco al {{ $value }}% en {{ $labels.mountpoint }} del nodo {{ $labels.node }}"99 - alert: NodeDiskIOHigh100 expr: rate(node_disk_io_time_seconds_total[5m]) > 0.9101 for: 5m102 labels:103 severity: warning104 annotations:105 summary: "IO de disco saturado en nodo {{ $labels.node }}"106 ```1071085. Configurar metricas de red para detectar problemas de comunicacion entre microservicios:109 ```yaml110 - alert: NodeNetworkErrors111 expr: rate(node_network_receive_errs_total[5m]) + rate(node_network_transmit_errs_total[5m]) > 10112 for: 3m113 labels:114 severity: warning115 annotations:116 summary: "Errores de red elevados en nodo {{ $labels.node }}"117 ```1181196. Crear dashboards de Grafana que correlacionen metricas de nodo con metricas del pipeline:120 ```json121 {122 "targets": [123 {124 "expr": "histogram_quantile(0.95, rate(kyc_verification_duration_seconds_bucket[5m]))",125 "legendFormat": "KYC Latency p95"126 },127 {128 "expr": "100 - avg(rate(node_cpu_seconds_total{mode='idle'}[5m])) * 100",129 "legendFormat": "CPU Usage %"130 }131 ]132 }133 ```1341357. Habilitar collectors especificos relevantes para los nodos de inferencia ML:136 ```bash137 node_exporter \138 --collector.cpu \139 --collector.meminfo \140 --collector.diskstats \141 --collector.netdev \142 --collector.loadavg \143 --collector.thermal_zone \144 --no-collector.wifi \145 --no-collector.zfs146 ```147148## Notes149150- En los nodos que ejecutan inferencia ML (face_match, liveness), prestar especial atencion a la memoria disponible ya que los modelos ArcFace e InsightFace consumen cantidades significativas de RAM.151- Las metricas de disco son criticas porque MinIO almacena temporalmente las imagenes de verificacion; si el disco se satura, todo el pipeline KYC se detiene.152- Usar `hostNetwork: true` es necesario para que Node Exporter acceda a las metricas reales del nodo, pero debe limitarse al namespace de monitoring con NetworkPolicies apropiadas.
Run npx skillmds@latest add davidcastagnetoa/node-exporter in your terminal (requires Node.js), paste this page's agent-chat prompt into Claude, Cursor, or any MCP-connected agent, or download the SKILL.md file and copy it into your agent's skills directory.
Exportador de metricas de sistema para correlacionar recursos del nodo con rendimiento KYC It is listed under Coding & Dev Tools on SkillMD.
This skill has not completed SkillMD's automated safety review yet. SkillMD never runs a skill's scripts for you; review the SKILL.md before installing.
This skill is tagged as working with Claude Code, Claude.ai, OpenAI Codex. SKILL.md is an open format, so most agents that read a skills directory can load it too.
Yes. Installing skills from SkillMD is free, and the skill stays under its author's original license.
davidcastagnetoa (@davidcastagnetoa) published this skill. Their other Agent Skills are listed on their SkillMD profile.