Views
No views yet
.whl) for Flash Attention 2, specifically built and optimized for the NVIDIA RTX 50 Series (Blackwell architecture).sm_120 (NVIDIA Blackwell - RTX 5070 Ti, 5080, 5090, etc.).whl file from the Files and versions tab.pip install flash_attn-2.8.3+cu129sm120-cp312-cp312-win_amd64.whl1import torch
2import flash_attn
3print(f"Flash Attention version: {flash_attn.__version__}")
4print(f"Device: {torch.cuda.get_device_name(0)}")sm_120. It may not work on older architectures (RTX 30/40 series).