EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization
يقدم البحث EmoAgent-R1، وهو إطار عمل مبتكر يستفيد من التخصص الديناميكي للوكلاء القائم على التعلم التعزيزي وخوارزمية تحسين السياسة النسبية للمجموعة التقدمية (P-GRPO) لتعزيز التعرف على العواطف متعدد الوسائط من خلال تمكين النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) من تكييف استراتيجيات الاستدلال الخاصة بها ديناميكيًا مع مصادر العواطف المعقدة والمتغيرة.