2026
Leveraging Machine Unlearning for Cost-Efficient Preference Alignment
ICML 2026poster
Despite advances in Preference Alignment (PA) for Large Language Models (LLMs), mainstream methods like reinforcement learning with human feedback face notable challenges. These approaches require high-quality datasets of positive preference examples, which are costly to obtain and computationally i…