2021
M3P: Learning Universal Representations via Multitask Multilingual Multimodal Pre-Training
CVPR 2021poster
We present M3P, a Multitask Multilingual Multimodal Pre-trained model that combines multilingual pre-training and multimodal pre-training into a unified framework via multitask pre-training. Our goal is to learn universal representations that can map objects occurred in different modalities or texts…