← Search

Quang Anh Pham

2 accepted papers

2026

Revisiting Distribution Correction Estimation for Offline Imitation Learning with Suboptimal Dataset

ICML 2026poster

Imitation Learning (IL) has demonstrated strong capabilities in learning high-quality policies from expert demonstrations for sequential decision-making tasks. Nonetheless, its effectiveness is significantly constrained in low-expert-data regimes. To mitigate this issue, previous works introduce ``*…

Cited by 0SourceScholar
2025

IOSTOM: Offline Imitation Learning from Observations via State Transition Occupancy Matching

NeurIPS 2025poster

Offline Learning from Observations (LfO) focuses on enabling agents to imitate expert behavior using datasets that contain only expert state trajectories and separate transition data with suboptimal actions. This setting is both practical and critical in real-world scenarios where direct environment…

Cited by 0SourceScholar