Towards Distillation-Resistant Large Language Models: An Information-Theoretic Perspective
تقترح هذه الورقة دفاعاً قائماً على نظرية المعلومات ضد تقطير النماذج القائم على اللوجيت (logit-based model distillation) من خلال تقليل المعلومات المتبادلة الشرطية بين لوجيتات المعلم واستعلامات المدخلات، مما يحمي نماذج اللغات الكبيرة المملوكة بفعالية من استخراج المعرفة مع الحفاظ على فائدتها في المهام.