Test-Time Scaling Makes Overtraining Compute-Optimal
تقدم هذه الورقة قوانين التوسع من التدريب إلى الاختبار () التي تُحسّن بشكل مشترك حجم النموذج، ورموز التدريب، وعينات الاستدلال في ظل ميزانيات ثابتة، مما يكشف أن مراعاة تكاليف وقت الاختبار تنقل استراتيجيات التدريب المسبق المثلى إلى نظام الإفراط في التدريب الذي يتفوق بشكل كبير على نهج التوسع القياسي.