2024
Enhancing Reinforcement Learning with Label-Sensitive Reward for Natural Language Understanding
ACL 2024long
Recent strides in large language models (LLMs) have yielded remarkable performance, leveraging reinforcement learning from human feedback (RLHF) to significantly enhance generation and alignment capabilities. However, RLHF encounters numerous challenges, including the objective mismatch issue, leadi…