Gpu Dispatch

Nutze das beim Dispatch lokaler Modelle auf GPUs — Inferenzarbeit planen, eine Karte wählen oder Modell-Residenz verwalten. Ein Modell pro GPU, kein Spill ins System-RAM, warm halten durch die Schleife, am Schleifenende entladen, Zulassung nach gemessener Wahrheit. Trigger words: gpu, vram, gpu dispatch, model loading, keep alive, resident model, local inference, spill, warm, Grafikkarte, Modell laden, lokale Inferenz, warmhalten.

Tcuzzo 1014fca 4.6 KB Updated

File contents

Tcuzzo/backs-aios-skills/tree/main/i18n/de/skills/gpu-dispatch commit 1014fcacb4

Frequently asked questions

npx skillmds@latest add tcuzzo/gpu-dispatch-2