Epistemic Gain, Aleatoric Cost: Uncertainty Decomposition in Multi-Agent Debate for Math Reasoning
تقترح هذه الورقة إطاراً لتفكيك عدم اليقين البايزي لتحليل المناظرة متعددة الوكلاء، كاشفةً أن الاستدلال الفعال يعتمد على تعظيم الكسب المعرفي مع تقليل التكلفة العشوائية، وتستفيد من هذه الرؤية لتصميم خوارزمية تعلم تعزيزي موجهة بعدم اليقين تعمل على تحسين دقة المناظرة واستدلال النماذج الفردية بشكل كبير.