2019
Learning Disentangled Representation in Latent Stochastic Models: A Case Study with Image Captioning
ICASSP 2019accepted
Multimodal tasks require learning joint representation across modalities. In this paper, we present an approach to employ latent stochastic models for a multimodal task image captioning. Encoder Decoder models with stochastic latent variables are often faced with optimization issues such as latent c…