Equivariant Spatio-Temporal Self-Supervision for LiDAR Object Detection
"Popular representation learning methods encourage feature invariance under transformations applied at the input. However, in 3D perception tasks like object localization and segmentation, outputs are naturally equivariant to some transformations, such as rotation. Using pre-training loss functions…