2023
A Framework for Vision-Language Warm-up Tasks in Multimodal Dialogue Models
EMNLP 2023long main
Most research on multimodal open-domain dialogue agents has focused on pretraining and multi-task learning using additional rich datasets beyond a given target dataset. However, methods for exploiting these additional datasets can be quite limited in real-world settings, creating a need for more eff…