2025
Identifying Unlearned Data in LLMs via Membership Inference Attacks
EMNLP 2025
Unlearning evaluation has traditionally followed the retrieval paradigm, where adversaries attempt to extract residual knowledge of an unlearning target by issuing queries to a language model. However, the absence of retrievable knowledge does not necessarily prevent an adversary from inferring whic