2026
Transport or Discard: Robust Unbalanced Optimal Transport for Cross-Domain Policy Adaptation
ICML 2026poster
Cross-domain offline reinforcement learning leverages a source dataset to improve policy learning in a data-scarce target domain, but dynamics mismatch makes many source transitions kinematically infeasible and can cause negative transfer. Recent non-parametric geometric methods (e.g., standard opti…