Scaling up Energy-Aware Multi-Agent Reinforcement Learning for Mission-Oriented Drone Networks with Individual Reward
تقترح هذه الورقة نموذجاً للتعلم التعزيزي متعدد الوكلاء يعتمد على الوعي بالطاقة باستخدام شبكات كيو العميقة (Deep Q-Networks) مع وظائف مكافأة فردية لتعزيز المتانة، وكفاءة الطاقة، ومعدل النجاح لشبكات الطائرات بدون طيار الموجهة نحو المهام، لا سيما عند التوسع في حجم البيئة وأعداد الوكلاء مقارنة بنهج المكافأة المشتركة التقليدي.