2026
Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement Learning
AAAI 2026technical
Deep Reinforcement Learning (DRL) systems are increasingly used in safety-critical applications, yet their security remains severely underexplored. This work investigates backdoor attacks, which implant hidden triggers that cause malicious actions only when specific inputs appear in the observation