2025
Benchmarking Retrieval-Augmented Multimomal Generation for Document Question Answering
NeurIPS 2025poster
Document Visual Question Answering (DocVQA) faces dual challenges in processing lengthy multimodal documents (text, images, tables) and performing cross-modal reasoning. Current document retrieval-augmented generation (DocRAG) methods remain limited by their text-centric approaches, frequently missi…