Beyond Questions: Evaluating What Large Language Models (Actually) Know
تقدم هذه الورقة البحثية "ما وراء الأسئلة" (BeQu)، وهو نموذج تقييم جديد للمعرفة المفتوحة يقيم النماذج اللغوية الكبيرة بناءً على المعرفة التي تعبر عنها بشكل طبيعي من خلال الاستدلال المفتوح بدلاً من الأسئلة المحددة مسبقاً، مما يكشف عن رؤى هامة حول قدرات النماذج عبر عوامل مختلفة مثل الحجم وجهد الاستدلال.