← Search

Xingxing Huang

2 accepted papers

2026

Jailbreaking Vision-Language Models via Dissonance-Guided Suffix Optimization and Image-Phrase Injection

CVPR 2026

The integration of vision and language in Vision-Language Models (VLMs), while enabling multimodal capabilities, inherently expands their attack surface. Among existing white-box jailbreak methods, suffix-optimization-based approaches often rely on gradient approximations over discrete token spaces,

Cited by 0SourcecodeScholar
2026

Logit-Margin Repulsion for Backdoor Defense

CVPR 2026

Backdoor attacks pose a significant threat to deep neural networks. Recent studies have shown that model compression, such as quantization and pruning, can be exploited by attackers to implant conditional backdoors. Such backdoors remain dormant in the original model but are activated after the mode

Cited by 0SourcecodeScholar