PointSDA: Spatio-Temporal Deformable Attention Network for Point Cloud Video Modeling
Point cloud videos are constituted of serialized point clouds captured continuously by the agent. Point cloud video modeling is significant for real-world action analysis and dynamic scene perception. Aggregating multi-level features is advantageous for these downstream tasks, while it is overlooked