flash-linear-attention

πŸš€ Efficient implementations for emerging model architectures

What is flash-linear-attention?

πŸš€ Efficient implementations for emerging model architectures