← Search

Aydin Javadov

1 accepted papers

2026

Compose and Fuse: Revisiting the Foundational Bottlenecks in Multimodal Reasoning

ICLR 2026poster

Multimodal large language models (MLLMs) promise enhanced reasoning by integrating diverse inputs such as text, vision, and audio. Yet, despite their perceptual strengths, their reasoning ability across modalities remains underexplored, with conflicting reports on whether additional modalities help…

Cited by 0SourceScholar