flash-linear-attention:基于Triton的高效线性注意力模型实现集合,跨平台支持

🚀 Efficient implementations for emerging model architectures

分支25Tags14

项目介绍

高效的 Pytorch 和 Triton 中最新线性注意力模型的实现【此简介由AI生成】

定制我的领域
355.4 K600访问 GitHub