Evaluating LLM-Simulated Conversations in Modeling Inconsistent and Uncollaborative Behaviors in Human Social Interaction
تقدم هذه الورقة CoCoEval، وهو إطار عمل للكشف عن السلوكيات غير المتسقة وغير التعاونية في المحادثات التي تحاكيها النماذج اللغوية الكبيرة، وتجد أن النماذج الحالية تكافح لمحاكاة تعقيد التفاعل الاجتماعي البشري بشكل أصيل بسبب الفروق الجوية الكبيرة في تكرار السلوك، وعدم موثوقية هندسة الأوامر، وميل الضبط الدقيق إلى إنتاج أنماط سلوكية ضيقة.