Stratifying Reinforcement Learning with Signal Temporal Logic
تقترح هذه الورقة دلالات قائمة على الطبقات لـ "منطق الزمن الإشاري" (STL) توجد علاقة تطابق بين صيغ هذا المنطق والطبقات الزمكانية، مما يوفر إطاراً نظرياً لتحليل وتفسير فضاءات التضمين لوكلاء التعلم التعزيزي العميق، وهو ما تم التحقق من صحته من خلال تطبيقات في ألعاب "ميني جريد" (Minigrid).