Code-Guided Reasoning for Small Language Models: Evaluating Executable MCQA Scaffolds
تقدم هذه الورقة "الاستدلال الموجه بالكود" (CGR)، وهو بروتوكول ومورد للتقييم يثبت أن السقالات البرمجية القابلة للتنفيذ تحسن بشكل كبير أداء النماذج اللغوية الصغيرة في مهام الأسئلة والأجوبة متعددة الخيارات، محققةً زيادة في الدقة قدرها 28.10 نقطة مئوية مقارنة بالإجابة المباشرة مع توفير بيانات تتبع شاملة لتحليل النتائج.