Generalized Gaussian Temporal Difference Error for Uncertainty-aware Reinforcement Learning
تقترح هذه الورقة إطار عمل للتعلم التعزيزي مدركاً لعدم اليقين يستبدل افتراض التوزيع الغاوسي التقليدي ذي المتوسط الصفري بتوزيع غاوسي معمّم مشروط بالحالة لنمذجة أخطاء فرق زمني ذات ذيول ثقيلة وتباين متباين بشكل أفضل، مما يؤدي إلى تحسين الأداء عبر مختلف معايير التحكم.