Optimizing Attention Flash

Speed up long-sequence transformer training and inference.

NousResearch f7608ca 3 files · 24.5 KB Updated

File contents

NousResearch/hermes-agent commit f7608cae9a

Frequently asked questions

npx skillmds@latest add nousresearch/optimizing-attention-flash