Dataset Poisoning Attacks on Behavioral Cloning Policies
تقدم هذه الورقة أول تحليل لهجمات الباب الخلفي نظيفة الملصقات (clean-label backdoor attacks) على سياسات محاكاة السلوك (Behavior Cloning)، حيث تُثبت أن مجموعات البيانات المسمومة بحد أدنى يمكن أن تنتج سياسات ذات أداء يقارب الأداء المرجعي ولكنها معرضة بشدة للاستغلال القائم على المحفزات، مع تقديم هجوم مبتكر يعتمد على الإنتروبيا في وقت الاختبار لزيادة تدهور أداء السياسة.