Agent skill · davila7
optimizing-attention-flash
Optimizes transformer attention with Flash Attention for 2-4x speedup and 10-20x memory reduction. Use when training/running transformers with long sequenc
Reference it in any coding agent with:
@skills davila7/optimizing-attention-flash