-fair heterogeneous agent reinforcement learning
यह शोध पत्र मल्टी-एजेंट सिस्टम में असमान पुरस्कार वितरण को संबोधित करने के लिए -फेयरनेस को हेट्रोजेनियस-एजेंट ट्रस्ट रीजन लर्निंग के साथ एकीकृत करने वाला एक नवीन ढांचा प्रस्तावित करता है, जो सैद्धांतिक रूप से पुष्ट एल्गोरिदम (-fair HATRPO और HAPPO) प्रदान करता है जो अनुक्रमिक सामाजिक दुविधाओं (sequential social dilemmas) में बेहतर उपयोगितावादी दक्षता और श्रेष्ठ सामाजिक कल्याण दोनों को प्राप्त करते हैं।