Saliency-Guided Representation with Consistency Policy Learning for Visual Unsupervised Reinforcement Learning
تقترح هذه الورقة إطار عمل SRCP، وهو إطار مبتكر يعزز التعلم التعزيزي البصري غير الخاضع للإشراف بنمط الصفر (zero-shot) عبر فصل تعلم التمثيل عن تدريب التابع من خلال مهمة ديناميكية موجهة بالبروز، ودمج سياسة اتساق مع توجيه خالٍ من المصنف للتغلب على قيود التمثيلات التابعة التقليدية في البيئات عالية الأبعاد.