热门
导航
快讯
推荐文章
热门
导航
快讯
推荐文章
#Accelerated Scan
accelerated-scan - GPU加速的并行扫描算法高效解决一阶递归
Accelerated Scan
GPU
并行计算
CUDA
Triton
Github
开源项目
accelerated-scan是一个Python包,实现了GPU上高效的一阶并行关联扫描。该项目采用分块处理算法和GPU通信原语,能快速处理状态空间模型和线性RNN中的一阶递归问题。支持前向和后向扫描,提供C++ CUDA内核和Triton实现,在不同序列长度下均有出色性能表现。适用于深度学习和信号处理等需要高性能递归计算的领域。
1
1
使用协议
隐私政策
广告服务
投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI
·
鲁ICP备2024100362号-6
·
鲁公网安备37021002001498号