Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization
تؤسس هذه الورقة أساساً نظرياً لتوحيد التعلم المعزز المشروط بالهدف وتعلم المهارات غير الخاضع للإشراف من خلال صياغة كليهما كحالات من تعظيم التحكم، مما يثبت أن أهداف تعلم المهارات القائمة على المعلومات المتبادلة محددة بـ وتتماشى بشكل أمثل مع صياغات وصول متميزة للأهداف.