2025
HLU: Human Vs LLM Generated Text Detection Dataset for Urdu at Multiple Granularities
COLING 2025main
The rise of large language models (LLMs) generating human-like text has raised concerns about misuse, especially in low-resource languages like Urdu. To address this gap, we introduce the HLU dataset, which consists of three datasets: Document, Paragraph, and Sentence level. The document-level datas…