2025
DCR: Quantifying Data Contamination in LLMs Evaluation
EMNLP 2025
The rapid advancement of large language models (LLMs) has heightened concerns about benchmark data contamination (BDC), where models inadvertently memorize evaluation data during the training process, inflating performance metrics, and undermining genuine generalization assessment. This paper introd