2026
Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in Conversation
AAAI 2026technical
Multimodal Emotion Recognition in Conversation (MERC) aims to predict speakers’ emotions by integrating textual, acoustic, and visual cues. Existing approaches either struggle to capture complex cross‑modal interactions or experience gradient conflicts and unstable training when using deeper archite