2025
Video-Panda: Parameter-efficient Alignment for Encoder-free Video-Language Models
CVPR 2025poster
We present an efficient encoder-free approach for video-language understanding that achieves competitive performance while significantly reducing computational overhead. Current video-language models typically rely on heavyweight image encoders (300M-1.1B parameters) or video encoders (1B-1.4B param…