Falsification-driven reinforcement learning for maritime motion planning
تقترح هذه الورقة نهجاً للتعلم المعزز القائم على التفنيد، والذي يولد سيناريوهات تدريب عدائية بناءً على مواصفات المنطق الزمني الإشاري لتحسين الامتثال لقواعد حركة المرور البحرية في تخطيط حركة السفن ذاتية القيادة.