Automatic Triton Programming

Train specialized LLMs to generate optimized Triton GPU kernels using RL with dual rewards for correctness and syntax compliance. 8B model achieves parity with Claude-Sonnet and DeepSeek-R1 by combining supervised fine-tuning on curated code pairs with RL exploration beyond imitation learning ceilings.

adu2021 a89211c 14.4 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/automatic-triton-programming commit a89211ca9c

Frequently asked questions

npx skillmds@latest add adu2021/automatic-triton-programming