← Search

Wenqian Yu

1 accepted papers

2025

Reimagining Safety Alignment with An Image

EMNLP 2025

Large language models (LLMs) excel in diverse applications but face dual challenges: generating harmful content under jailbreak attacks and over-refusing benign queries due to rigid safety mechanisms. These issues severely affect the application of LLMs, especially in the medical and education field