2026
Position: We Need Large Language Models Optimized For Our Well-Being
ICML 2026poster
Contemporary large language models are predominantly trained using reinforcement learning from human feedback (RLHF), optimizing for immediate user approval rather than long-term well-being. This position paper argues that as AI systems increasingly serve socioemotional functions, this optimization …