A Reward-Petri-Net Interpretation of Temporal Behavior Trees
यह शोध पत्र टेम्पोरल बिहेवियर ट्रीज़ (Temporal Behavior Trees) को रिवॉर्ड-पेट्री-नेट्स (Reward-Petri-Nets) के रूप में व्याख्या करने का प्रस्ताव करता है ताकि सुदृढीकरण शिक्षण (reinforcement learning) के लिए संरचित रिवॉर्ड फंक्शन स्वचालित रूप से उत्पन्न किए जा सकें, जिससे उन जटिल, लंबी अवधि वाले रोबोटिक कार्यों के कुशल शिक्षण को सक्षम बनाया जा सके जहाँ मानक विधियाँ विफल हो जाती हैं जिनमें पदानुक्रमित और टेम्पोरल बाधाएँ शामिल हैं।