Flash Attention

Speed up long-sequence transformer training and inference.

gabrielmoreira Updated 17 repo stars

File contents

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/NousResearch@hermes-agent/optional-skills/mlops/flash-attention commit fc49f70b94

Frequently asked questions

npx skillmds@latest add gabrielmoreira/flash-attention