← Search

Yangguang Ji

1 accepted papers

2025

RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought

ACL 2025long

Multi-modal Large Language Models (MLLMs) have demonstrated remarkable reasoning capability while lack explicit mechanisms for visual grounding and segmentation, creating a gap between cognitive reasoning and visual perception. To bridge this gap, we introduce Reasoning Segmentation via Visual Promp…

Cited by 0SourcePDFScholar