← Search

Duy Van Phung

1 accepted papers

2023

trlX: A Framework for Large Scale Reinforcement Learning from Human Feedback

EMNLP 2023long main

Reinforcement learning from human feedback (\textbf{RLHF}) utilizes human feedback to better align large language models with human preferences via online optimization against a learned reward model. Current RLHF paradigms rely on Proximal Policy Optimization (\textbf{PPO}), which quickly becomes a…

Cited by 0SourceScholar