2025
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
EMNLP 2025
Video Large Language Models (Video LLMs) have achieved remarkable results in video understanding tasks. However, they often suffer from heavy computational overhead due to the large number of visual tokens generated from multiple video frames. Existing visual token compression methods often rely on