Interpretable Failure Analysis in Multi-Agent Reinforcement Learning Systems
यह शोध पत्र एक दो-चरणीय, ग्रेडिएंट-आधारित ढांचे को प्रस्तुत करता है जो पॉलिसी ग्रेडिएंट्स और क्रिटिक डेरिवेटिव्स के ज्यामितीय विश्लेषण के माध्यम से प्रारंभिक विफलता स्रोतों का सटीक रूप से पता लगाकर और प्रसार मार्गों का पता लगाकर मल्टी-एजेंट सुदृढीकरण शिक्षण (मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग) प्रणालियों में व्याख्या योग्य विफलता विश्लेषण को सक्षम बनाता है।