2023
XtremeCLIP: Extremely Parameter-efficient Tuning for Low-resource Vision Language Understanding
ACL 2023findings
Recently, Contrastive Visual-Language Pre-training (CLIP) has demonstrated remarkable capability in various Visual Language Understanding (VLU) tasks. Yet, most CLIP-based methods require tasks-specific designs and sufficient training data. In this paper, we introduce a simple yet efficient paradigm…