2025
Efficient Transfer Learning for Video-language Foundation Models
CVPR 2025poster
Pre-trained vision-language models provide a robust foundation for efficient transfer learning across various downstream tasks. In the field of video action recognition, mainstream approaches often introduce additional modules to capture temporal information. Although the additional modules increase…