Asynchronous MultiAgent Reinforcement Learning for 5G Routing under Side Constraints
تقترح هذه الورقة إطار عمل لتعلم تعزيزي متعدد الوكلاء غير متزامن، حيث تنسق وكلاء (PPO) مستقلون عبر بيئة موارد مشتركة لتحقيق توجيه شبكات الجيل الخامس (5G) قابل للتوسع، وقوي، ومتخصص يطابق أداء النماذج المركزية المرجعية مع تقليل وقت التدريب بشكل كبير.