2026
Provably Protecting Fine-Tuned LLMs from Training Data Extraction
ICML 2026poster
Fine-tuning large language models (LLMs) on sensitive datasets raises privacy concerns, as training data extraction (TDE) attacks can expose highly confidential information. Existing defenses against such attacks either lack formal privacy guarantees or incur substantial utility degradation. We obse…