LLMs Can Predict Failure Risk, But Struggle to Predict Which Collaboration Protocol Pays Off: Cost-Aware Protocol Routing Across Reasoning Tasks
بينما يمكن للنماذج اللغوية الكبيرة التنبؤ بفعالية بمخاطر الفشل العامة لتبرير التصعيد إلى التعاون، إلا أنها تعاني حالياً من صعوبة في التحديد الدقيق لبروتوكول التعاون النوعي (مثل التصحيح الذاتي التكراري، أو المخطط-المنفذ-المراجع، أو المداولة متعددة الوكلاء) الذي سيحقق أفضل مقايضة بين التكلفة والأداء لمهمة استدلالية معينة.