Flash Attention Kernel Optimization

Accelerates transformer attention computation with IO-aware memory access and tiling.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/flash-attention-kernel-optimization commit 55ee6dbcfa

Frequently asked questions

npx skillmds@latest add robertoatila/flash-attention-kernel-optimization