Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
تُثبت هذه الورقة بشكل منهجي أن صعوبة البيانات المثلى للضبط الدقيق الخاضع للإشراف للنماذج اللغوية الكبيرة تعتمد على حجم مجموعة البيانات، مما يكشف عن مقايضة بين التعميم والاستقراء حيث تستفيد ميزانيات البيانات الأكبر من الأمثلة الأكثر صعوبة.