2025
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
ACL 2025finding
Language models (LMs) risk inadvertently memorizing and divulging sensitive or personally identifiable information (PII) seen in training data, causing privacy concerns. Current approaches to address this issue involve costly dataset scrubbing, or model filtering through unlearning and model editing…