← Search

Chia-Heng Hsu

1 accepted papers

2026

From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning

ICML 2026poster

Preference-based reinforcement learning (PbRL) avoids explicit reward engineering by learning from pairwise human preference feedback. Existing offline PbRL methods typically follow a two-stage pipeline, first learning a reward or preference model from labeled preferences and then performing offline…

Cited by 0SourceScholar