2026
The Devil behind the mask: An emergent safety vulnerability of Diffusion LLMs
ICLR 2026poster
Diffusion-based large language models (dLLMs) have recently emerged as a powerful alternative to autoregressive LLMs, offering faster inference and greater interactivity via parallel decoding and bidirectional modeling. However, despite strong performance in code generation and text infilling, we i…