Latent Activation Editing: Inference-Time Refinement of Learned Policies for Safer Multirobot Navigation
Reinforcement learning has enabled significant progress in complex domains such as coordinating and navigating multiple quadrotors. However, even well-trained policies remain vulnerable to collisions in obstacle-rich environments. Addressing these infrequent but critical safety failures through retr…