2026
CultureRL: Internalizing Cultural Principles in Large Language Models via Norm-Driven Reinforcement Learning
AAAI 2026technical
As large language models (LLMs) are increasingly deployed across culturally diverse regions, ensuring that their responses align with users’ cultural norms has become a critical challenge. Existing approaches to cultural alignment primarily rely on prompting or data-augmentation-based supervised fin