← Search

Yibing Guo

1 accepted papers

2025

DCR: Quantifying Data Contamination in LLMs Evaluation

EMNLP 2025

The rapid advancement of large language models (LLMs) has heightened concerns about benchmark data contamination (BDC), where models inadvertently memorize evaluation data during the training process, inflating performance metrics, and undermining genuine generalization assessment. This paper introd