← Search

Naila Khan

1 accepted papers

2025

PersonaLens: A Benchmark for Personalization Evaluation in Conversational AI Assistants

ACL 2025finding

Large language models (LLMs) have advanced conversational AI assistants. However, systematically evaluating how well these assistants apply personalization—adapting to individual user preferences while completing tasks—remains challenging. Existing personalization benchmarks focus on chit-chat, non-…