★ 22 · Updated 2026-06-30
Optimizes transformer attention using Flash Attention via PyTorch SDPA, flash-attn library, H100 FP8, and sliding window attention.
Browse skills that share this tag.
★ 22 · Updated 2026-06-30
Optimizes transformer attention using Flash Attention via PyTorch SDPA, flash-attn library, H100 FP8, and sliding window attention.