← Search

Daiwei Chen

1 accepted papers

2025

PAL: Sample-Efficient Personalized Reward Modeling for Pluralistic Alignment

ICLR 2025poster

Foundation models trained on internet-scale data benefit from extensive alignment to human preferences before deployment. However, existing methods typically assume a homogeneous preference shared by all individuals, overlooking the diversity inherent in human values. In this work, we propose a gene…

Cited by 2SourcePDFScholar