Anticipatory Evaluation of Language Models
تقدم هذه الورقة PRECOG، وهو متن من أوصاف المهام ومقاييس الأداء، لتوضيح أن النماذج اللغوية الكبيرة يمكنها التنبؤ بنتائج التقييم بناءً فقط على أوصاف المهام والتكوينات التجريبية، مما يوفر مساراً للتغلب على عنق الزجاجة الحالي في تقييم أبحاث الذكاء الاصطناعي.