optimizing-attention-flash
Optimize transformer attention with PyTorch SDPA or flash-attn to reduce memory usage.
npx skills add https://github.com/twjarviszyra-web/hermes-unbound --skill optimizing-attention-flash-twjarviszyra-web
Or copy as Structured Prompt for Agent▼
Please help me install this Agent Skill. Skill: optimizing-attention-flash Source: https://github.com/twjarviszyra-web/hermes-unbound/tree/main/optional-skills/mlops/flash-attention Command: npx skills add https://github.com/twjarviszyra-web/hermes-unbound --skill optimizing-attention-flash-twjarviszyra-web