Nvidia Rate Limit

Presupuesto de peticiones del backend NVIDIA NIM (DeepSeek) — máximo 40 RPM, objetivo <35 RPM y ~1000 créditos de inferencia. Aplicar SIEMPRE: batch de tool calls en un solo mensaje, un script local determinista en vez de N pasos del modelo, sin subagentes paralelos innecesarios, sin lecturas repetidas, salida concisa. Trigger: cualquier sesión sobre NVIDIA DeepSeek, trabajo a escala (multi-repo/multi-archivo), o cuando el usuario pida "menos de 35 peticiones por minuto".

belentani7 Updated

File contents

belentani7/agent-skills/tree/main/skills/nvidia-rate-limit commit 7fff27b974

Frequently asked questions

npx skillmds@latest add belentani7/nvidia-rate-limit