← Search

Qinzhi Peng

1 accepted papers

2026

LLaVAShield: Safeguarding Multimodal Multi-Turn Dialogues in Vision-Language Models

CVPR 2026

As Vision-Language Models (VLMs) move into interactive, multi-turn use, safety concerns intensify for multimodal multi-turn dialogue, which is characterized by concealment of malicious intent, contextual risk accumulation, and cross-modal joint risk. These characteristics limit the effectiveness of

Cited by 0SourceScholar