#鸟瞰图表示
相关项目
bevfusion
BEVFusion是一个有效的多任务多传感器融合框架,通过在共享的鸟瞰视角表示空间中统一多模态特征,解决了传统点级融合方法的局限性。其优化的视角转换和显著降迟特性使其在各种3D感知任务中表现出色。该框架在提升3D物体检测和BEV图分割性能的同时,大幅降低计算成本,树立了新行业标杆。
BEVFormer
BEVFormer是一个用于自动驾驶感知的开源框架,通过时空Transformer从多摄像头图像中学习统一的鸟瞰图表示。该方法利用预定义的网格查询,结合空间交叉注意力和时间自注意力机制,有效聚合多视角的空间和时序信息。在nuScenes测试集上,BEVFormer达到56.9%的NDS指标,显著超越现有方法,与激光雷达系统性能相当。这一创新为基于纯视觉的3D目标检测提供了新的基准。