Agent skill · davila7

optimizing-attention-flash

Optimizes transformer attention with Flash Attention for 2-4x speedup and 10-20x memory reduction. Use when training/running transformers with long sequenc

Reference it in any coding agent with:

@skills davila7/optimizing-attention-flash

Browse the @skills marketplace