Independent Learning of Nash Equilibria in Partially Observable Markov Potential Games with Decoupled Dynamics
تقترح هذه الورقة خوارزمية تعلم مستقلة لألعاب ماركوف ذات الإمكانات الجزئية الملاحظة ذات الديناميكيات المنفصلة، والتي تحقق تقارب توازن ناش التقريبي بتعقيد شبه متعدد الحدود من خلال الاستفادة من استقرار المرشح لتقريب المشكلة عبر نوافذ تاريخية محدودة ولعبة ماركوف بديلة ذات إمكانات قريبة.