DOPPLER: Dual-Policy Learning for Device Assignment in Asynchronous Dataflow Graphs
यह शोध पत्र डॉप्लर (Doppler) को प्रस्तुत करता है, जो एक तीन-चरणीय द्वि-नीति शिक्षण ढांचा (three-stage dual-policy learning framework) है, जो ऑपरेशन चयन और प्लेसमेंट नीतियों को संयोजित करके एसिंक्रोनस डेटाफ्लो ग्राफ के लिए डिवाइस असाइनमेंट को अनुकूलित करता है ताकि निष्पादन समय को कम करने और प्रशिक्षण दक्षता में सुधार करने में मौजूदा लर्निंग-आधारित और ह्यूरिस्टिक विधियों से बेहतर प्रदर्शन किया जा सके।