← Search

Joonki Min

1 accepted papers

2026

Fine-Grained Multi Image Object Hallucination Benchmark

CVPR 2026

Multimodal Large Language Models (MLLMs) are increasingly deployed in multi-image scenarios requiring complex reasoning across visual contexts. However, current MLLMs remain fundamentally limited by object hallucination--generating plausible yet factually inconsistent descriptions about objects. Exi

Cited by 0SourceScholar