Probabilistic Performance Guarantees for Multi-Task Reinforcement Learning
यह शोध पत्र मल्टी-टास्क रिइन्फोर्समेंट लर्निंग के लिए एक नवीन दृष्टिकोण प्रस्तुत करता है जो प्रति-कार्य लोअर कॉन्फिडेंस बाउंड्स को नमूना लिए गए कार्यों में कार्य-स्तरीय सामान्यीकरण के साथ जोड़कर अनदेखे कार्यों के लिए औपचारिक, उच्च-विश्वास प्रदर्शन गारंटी प्रदान करता है।