FlexAttention nutzt FlashAttention‑4 – flexibler Hopper & Blackwell
FlexAttention hat jetzt einen FlashAttention‑4‑Backend auf den neuesten NVIDIA GPUs Hopper und Blackwell. Das bedeutet deutlich schnellere und gleichzeitig anpassbare Attention‑Berechnungen. In PyTorch wurde die automat…