Intrinsic Fingerprint of LLMs: Continue Training is NOT All You Need to Steal A Model!
تقترح هذه الورقة طريقة قوية لتحديد بصمة النماذج اللغوية الكبيرة بناءً على توزيعات الانحراف المعياري المستقرة لمصفوفات معاملات الانتباه، مما يثبت أن هذه التوقيعات الجوهرية يمكنها تحديد سلالة النموذج وكشف انتهاك حقوق الطبع والنشر حتى بعد التدريب المستمر المكثف أو عملية إعادة التدوء (upcycling).