2025
PersonaLens: A Benchmark for Personalization Evaluation in Conversational AI Assistants
ACL 2025finding
Large language models (LLMs) have advanced conversational AI assistants. However, systematically evaluating how well these assistants apply personalization—adapting to individual user preferences while completing tasks—remains challenging. Existing personalization benchmarks focus on chit-chat, non-…