← Search

Qingying Sun

1 accepted papers

2025

Vision-aided Unsupervised Constituency Parsing with Multi-MLLM Debating

ACL 2025finding

This paper presents a novel framework for vision-aided unsupervised constituency parsing (VUCP), leveraging multimodal large language models (MLLMs) pre-trained on diverse image-text or video-text data. Unlike previous methods requiring explicit cross-modal alignment, our approach eliminates this ne…

Cited by 0SourcePDFScholar