Dyna-Style Safety Augmented Reinforcement Learning: Staying Safe in the Face of Uncertainty
تقترح الورقة البحثية خوارزمية Dyna-SAuR، وهي خوارزمية تعلم تعزيزي مبتكرة تستخدم نموذج ديناميكيات مدرك لعدم اليقين تم تعلمه لتدريب مرشح سلامة وسياسة تحكم قابل للتوسع في آن واحد، مما يقلل بشكل كبير من حالات فشل التدريب في الأنظمة عالية الأبعاد مقارنة بالأساليب المتطورة.