Theory of Optimal Learning Rate Schedules and Scaling Laws for a Random Feature Model
यह शोध पत्र अनुकूल नियंत्रण सिद्धांत (optimal control theory) का उपयोग करके रैंडम फीचर मॉडल्स के लिए इष्टतम लर्निंग रेट शेड्यूल्स को सैद्धांतिक रूप से व्युत्पन्न और मान्य करता है, जो विशिष्ट "आसान" और "कठिन" प्रशिक्षण चरणों की पहचान करता है जो यह निर्धारित करते हैं कि मानक बेंचमार्क की तुलना में पॉलीनोमियल डिके या वॉर्मअप-स्टेबल-डिके रणनीतियाँ बेहतर प्रदर्शन प्रदान करती हैं।