Gap-K%: Measuring Top-1 Prediction Gap for Detecting Pretraining Data
تقترح الورقة البحثية Gap-K%، وهي طريقة مبتكرة للكشف عن بيانات ما قبل التدريب في النماذج اللغوية الكبيرة، والتي تستفيد من فجوة الاحتمال اللوغاريتمي بين التنبؤ الأول (top-1) والرمز المستهدف، بالاقتران مع استراتيجية النافذة المنزلقة، لتحقيق أداء رائد على مجموعات البيانات المرجعية.