VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning
Large language model (LLM) agents have emerged as a promising solution for enhancing recommendation systems via user simulation. However, existing studies predominantly resort to prompt-based simulation using frozen LLMs, which frequently results in suboptimal item modeling and user preference learn