Flare Fast Low Rank Attention

Implement low-rank attention routing using encode-decode factorization to achieve linear-time complexity on long sequences while maintaining compatibility with optimized attention kernels.

adu2021 Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/flare-fast-low-rank-attention commit c12282176f

Frequently asked questions

npx skillmds@latest add adu2021/flare-fast-low-rank-attention