2026
Robust-R1: Degradation-Aware Reasoning for Robust Visual Understanding
AAAI 2026technical
Multimodal Large Language Models struggle to maintain reliable performance under extreme real-world visual degradations, which impede their practical robustness. Existing robust MLLMs predominantly rely on implicit training/adaptation that focuses solely on visual encoder generalization, suffering f