Combining Trained Models in Reinforcement Learning
تقدم هذه الورقة مراجعة منهجية مسترشدة بمنهجية "بريزما" (PRISMA) لـ 15 دراسة تجريبية حول إعادة استخدام النماذج سابقة التدريب في التعلم التعزيزي العميق، كاشفةً أن نجاح النقل يعتمد بشدة على تشابه المهام وآليات المحاذاة، مع تسليط الضوء على نقص حاد في المقارنات العادلة والمتوافقة حوسبياً في الأدبيات الحالية.