Gpu Dispatch

À utiliser pour dispatcher des modèles locaux sur les GPU — planifier l'inférence, choisir une carte, ou gérer la résidence des modèles. Un modèle par GPU, aucun débordement vers la RAM système, garder chaud pendant toute la boucle, décharger en fin de boucle, admettre sur vérité mesurée. Trigger words: gpu, vram, gpu dispatch, model loading, keep alive, resident model, local inference, spill, warm, carte graphique, chargement de modèle, modèle résident, inférence locale, débordement, garder chaud.

Tcuzzo 1b8bd62 5.0 KB Updated

File contents

Tcuzzo/backs-aios-skills/tree/main/i18n/fr/skills/gpu-dispatch commit 1b8bd626e7

Frequently asked questions

npx skillmds@latest add tcuzzo/gpu-dispatch-4