← Search

Junliang Du

4 accepted papers

2025

DAPE-BR: Distance-Aware Positional Encoding for Mitigating Object Hallucination in LVLMs

EMNLP 2025

Large Vision–Language Models (LVLMs) have garnered substantial interest owing to their impressive ability to interpret visual inputs and converse with users.Nevertheless, LVLMs still suffer from object hallucination – generating descriptions for objects that are absent from the image, which undermin

Cited by 0SourcePDFScholar
2025

MAFMO: Multi-modal Adaptive Fusion with Meta-template Optimization for Vision-Language Models

EMNLP 2025

Vision-language models like CLIP demonstrate exceptional generalization capabilities but face significant adaptation challenges due to parameter scale, prompt sensitivity, and cross-modal alignment difficulties. Existing approaches primarily focus on single-modality adjustments, leading to suboptima

Cited by 0SourcePDFScholar