2025
VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented Generation
COLING 2025main
We propose the VLR-Bench, a visual question answering (VQA) benchmark for evaluating vision language models (VLMs) based on retrieval augmented generation (RAG). Unlike existing evaluation datasets for external knowledge-based VQA, the proposed VLR-Bench includes five input passages. This allows tes…