2026
Attentive AV-FusionNet: Audio-Visual Quality Prediction with Hybrid Attention
ICASSP 2026oral
We introduce a novel deep learning-based audio-visual quality (AVQ) prediction model that leverages internal features from state-of-the-art unimodal predictors. Unlike prior approaches that rely on simple fusion strategies, our model employs a hybrid representation that combines learned Generative M…