← Search

Guanzhong He

1 accepted papers

2026

WebSeer: Training Deeper Search Agents through Reinforcement Learning with Self-Reflection

ICLR 2026poster

Search agents have achieved significant advancements in enabling intelligent information retrieval and decision-making within interactive environments. Although reinforcement learning has been employed to train agentic models capable of more dynamic interactive retrieval, existing methods are limite…

Cited by 0SourcecodeScholar