Narrow Finetuning Leaves Clearly Readable Traces in Activation Differences
تُظهر هذه الورقة أن الضبط الدقيق الضيق يترك انحيازات متميزة وقابلة للتفسير في تنشيطات النماذج اللغوية الكبيرة، والتي يمكن استخراجها عبر مقارنة النماذج لإعادة بناء خصائص بيانات التدريب وتعزيز قابلية التفسير، بينما تحذر من أن هذه النماذج قد لا تمثل بدقة سيناريوهات الضبط الدقيق الأوسع وتقترح أن خلط بيانات ما قبل التدريب يمكن أن يخفف من آثار الإفراط في التخصيص هذه.