2026
FutureOmni: Evaluating Future Forecasting from Omni-Modal Context for Multimodal LLMs
ICML 2026poster
Although Multimodal Large Language Models (MLLMs) demonstrate strong omni-modal perception, their ability to forecast future events from audio-visual cues remains largely unexplored, as existing benchmarks focus mainly on retrospective understanding. To bridge this gap, we introduce FutureOmni, the …