2019
Modality Attention for End-to-end Audio-visual Speech Recognition
ICASSP 2019accepted
Audio-visual speech recognition (AVSR) system is thought to be one of the most promising solutions for robust speech recognition, especially in noisy environment. In this paper, we propose a novel multimodal attention based method for audio-visual speech recognition which could automatically learn t…