Nvidia Tensorrt LLM Perf Host Optimization

Profiles and optimizes TensorRT-LLM host/CPU overhead using line_profiler (with nsys support planned). Runs iterative profile-analyze-optimize-validate rounds. Use when GPU utilization is low or optimizing PyExecutor throughput.

autohandai Updated

File contents

autohandai/community-skills/tree/main/nvidia-tensorrt-llm-perf-host-optimization commit 52f366294e

Frequently asked questions

npx skillmds@latest add autohandai-community-skills/nvidia-tensorrt-llm-perf-host-optimization