2024
Conditional Language Policy: A General Framework For Steerable Multi-Objective Finetuning
EMNLP 2024finding
Reward-based finetuning is crucial for aligning language policies with intended behaviors (*e.g.*, creativity and safety). A key challenge is to develop steerable language models that trade-off multiple (conflicting) objectives in a flexible and efficient manner. This paper presents Conditional Lang…