2025
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
CVPR 2025poster
In rapidly evolving field of vision-language models (VLMs), contrastive language-image pre-training (CLIP) has made significant strides, becoming foundation for various downstream tasks. However, relying on one-to-one (image, text) contrastive paradigm to learn alignment from large-scale messy web d…