2025
Uncertainty-aware Preference Alignment for Diffusion Policies
NeurIPS 2025poster
Recent advancements in diffusion policies have demonstrated promising performance in decision-making tasks. To align these policies with human preferences, a common approach is incorporating Preference-based Reinforcement Learning (PbRL) into policy tuning. However, since preference data is practica…