Rotary Embedding Kernel

Optimize Rotary Position Embedding (RoPE) kernels in Triton for NVIDIA and AMD GPUs. Covers interleaved/sequential layouts, sincos precomputation, and multi-row processing. Use when writing or optimizing RoPE, position embeddings, or rotary transformations.

ZJLi2013 Updated

File contents

ZJLi2013/awesome-kernel-skills/tree/main/skills/kernels/rotary-embedding commit f6d2c68c09

Frequently asked questions

npx skillmds@latest add zjli2013/rotary-embedding-kernel