Operator-Guided Invariance Learning for Continuous Reinforcement Learning
تقترح هذه الورقة إطار عمل VPSD-RL، وهو إطار للتعلم المعزز المستمر يكتشف بنيات دقيقة وتقريبية حافظة للقيمة عبر مؤثرات زمرة لي (Lie-group) وتطبيقات السحب الخلفي (pullback mappings) لتعزيز كفاءة البيانات والمتانة ضد التباين غير المرغوب فيه.