← Search

Xiaolong Guo

1 accepted papers

2026

Dynamic Deep Prompt Optimization for Defending Against Jailbreak Attacks on LLMs

AAAI 2026technical

Large Language Models (LLMs) demonstrate impressive capabilities across many applications but remain vulnerable to jailbreak attacks, which elicit harmful or unintended content. While model fine-tuning is an option for safety alignment, it is costly and prone to catastrophic forgetting. Prompt optim

Cited by 0SourcePDFScholar