← Search

Abu Hanif Muhammad Syarubany

1 accepted papers

2025

A Gradient Guidance Perspective on Stepwise Preference Optimization for Diffusion Models

NeurIPS 2025poster

Direct Preference Optimization (DPO) is a key framework for aligning text-to-image models with human preferences, extended by Stepwise Preference Optimization (SPO) to leverage intermediate steps for preference learning, generating more aesthetically pleasing images with significantly less computati…

Cited by 0SourcecodeScholar