← Search

Mark Huasong Meng

1 accepted papers

2026

Controllable and explainable personality sliders for LLMs at inference time

ICML 2026poster

Aligning Large Language Models (LLMs) with specific personas typically relies on Supervised Fine-Tuning (SFT) or Reinforcement Learning from Human Feedback (RLHF); however, these methods are resource-intensive, requiring expensive data collection and distinct model training for each target personali…

Cited by 0SourceScholar