Tilegym Converting Cutile To Triton

Converts cuTile GPU kernels (@ct.kernel) to Triton (@triton.jit). Handles standard in-repo conversion, debugging (cudaErrorIllegalAddress, shape mismatch, numerical mismatch), and mapping cuTile idioms (ct.load/ct.store, ct.Constant, ct.launch) to Triton equivalents. Covers dual-kernel layout flags (e.g. transpose=True/False + autotune grid via META) per translations/advanced-patterns.md. Use when converting, porting, or translating cuTile kernels to Triton, or debugging existing Triton translations.

NVIDIA Updated 2.2k repo stars

File contents

NVIDIA/skills/tree/main/skills/tilegym-converting-cutile-to-triton commit faef843374

Frequently asked questions

npx skillmds@latest add nvidia/tilegym-converting-cutile-to-triton