Designing Time Series Experiments in A/B Testing with Transformer Reinforcement Learning
تتناول هذه الورقة أوجه القصور في تصميمات اختبارات (A/B) للسلاسل الزمنية من خلال اقتراح نهج يعتمد على التعلم المعزز بنموذج "ترانسفورمر" يستفيد من السياق التاريخي الكامل ويقوم بتحسين متوسط مربع الخطأ مباشرة دون افتراضات تقييدية، مما يظهر أداءً فائقاً عبر مجموعات البيانات الاصطناعية والمحاكات والبيانات الواقعية.