Neural Models and Language Model Prompting for the Multidimensional Evaluation of Open-Ended Conversations
تتناول هذه الورقة تقييم المحادثات مفتوحة النهاية في تحدي DSTC-12 من خلال مقارنة توجيه النماذج اللغوية صغيرة النطاق مقابل نماذج التشفير والتدريب القائمة على الانحدار والتصنيف، حيث وجدت أنه بينما حقق التوجيه ارتباطات متواضعة والمركز الثاني، أظهرت النماذج المدربة الأصغر أداءً عالياً في التحقق رغم تحديات مجموعة الاختبار الناجمة عن تحولات توزيع درجات التوسيم.