← Search

Abdulrahman Diaa

2 accepted papers

2025

Optimizing Adaptive Attacks against Watermarks for Language Models

ICML 2025spotlight

Large Language Models (LLMs) can be misused to spread unwanted content at scale. Content watermarking deters misuse by hiding messages in content, enabling its detection using a secret *watermarking key*. Robustness is a core security property, stating that evading detection requires (significant) d…

2024

Leveraging Optimization for Adaptive Attacks on Image Watermarks

ICLR 2024poster

Untrustworthy users can misuse image generators to synthesize high-quality deepfakes and engage in unethical activities. Watermarking deters misuse by marking generated content with a hidden message, enabling its detection using a secret watermarking key. A core security property of watermarking is…