← Search

Ganesh Mallya

1 accepted papers

2025

VideoComp: Advancing Fine-Grained Compositional and Temporal Alignment in Video-Text Models

CVPR 2025poster

We introduce VideoComp, a benchmark and learning framework for advancing video-text compositionality understanding, aimed at improving vision-language models (VLMs) in fine-grained temporal alignment. Unlike existing benchmarks focused on static image-text compositionality or isolated single-event v…