Nvidia Tilegym Converting Cutile To Triton

Converts cuTile GPU kernels (@ct.kernel) to Triton (@triton.jit). Handles standard in-repo conversion, debugging (cudaErrorIllegalAddress, shape mismatch, numerical mismatch), and mapping cuTile idioms (ct.load/ct.store, ct.Constant, ct.launch) to Triton equivalents. Covers dual-kernel layout flags (e.g. transpose=True/False + autotune grid via META) per translations/advanced-patterns.md. Use when converting, porting, or translating cuTile kernels to Triton, or debugging existing Triton translations.

autohandai Updated

File contents

autohandai/community-skills/tree/main/nvidia-tilegym-converting-cutile-to-triton commit 6049547eb1

Frequently asked questions

npx skillmds@latest add autohandai-community-skills/nvidia-tilegym-converting-cutile-to-triton