Reinforcement-learning control of turbulence transition in the modified Hasegawa-Wakatani system
تُثبت هذه الورقة أن وكلاء التعلم التعزيزي، الموجهين بتهيئة مستندة إلى الفيزياء والمقترنين بمحلل مُحسَّن لوحدات معالجة الرسومات، يمكنهم التحكم بفعالية في انتقالات تدفق الاضطراب-النطاقي في نظام "هاسيجاوا-واكاتاني" المعدل من خلال اكتشاف استراتيجيات تفعيل مثلى تتفوق على النماذج المرجعية التقليدية في كل من مهام كبح الاضطراب ومهام كسر النطاق.