2025
Relation-Rich Visual Document Generator for Visual Information Extraction
CVPR 2025poster
Despite advances in Large Language Models (LLMs) and Multimodal LLMs (MLLMs) for visual document understanding (VDU), visual information extraction (VIE) from relation-rich documents remains challenging due to the layout diversity and limited training data. While existing synthetic document generato…