Tensorrt Optimization

Authoritative guide to inference optimization using TensorRT, focusing on quantization, layer fusion, and memory bandwidth optimization for LLMs.

j4flmao Updated

File contents

j4flmao/agent-skills/tree/main/skills/hardware-acceleration/tensorrt-optimization commit 9b66d56c3a

Frequently asked questions

npx skillmds@latest add j4flmao/tensorrt-optimization