torch==2.12.1 numpy==2.4.6 tokenizers==0.22.2 flash-linear-attention==0.5.1 # CUDA-only (Triton kernels) # on Windows also: triton-windows==3.7.1.post27