2026
Rethinking Direct Preference Optimization in Diffusion Models
AAAI 2026technical
Aligning text-to-image (T2I) diffusion models with human preferences has emerged as a critical research challenge. While Direct Preference Optimization (DPO) has established a foundation for preference learning in large language models (LLMs), its extension to diffusion models remains limited in ali