← Search

Zi-Han Jiang

1 accepted papers

2025

Relation-Rich Visual Document Generator for Visual Information Extraction

CVPR 2025poster

Despite advances in Large Language Models (LLMs) and Multimodal LLMs (MLLMs) for visual document understanding (VDU), visual information extraction (VIE) from relation-rich documents remains challenging due to the layout diversity and limited training data. While existing synthetic document generato…