PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing
تقدم الورقة البحثية PATCH، وهي طريقة مبتكرة تحدد وتعدل مباشرةً الدوائر الحسابية المحددة المسؤولة عن تسريب معلومات الهوية الشخصية (PII) في النماذج اللغوية، محققةً توازناً أفضل بكثير بين الخصوصية والمنفعة وتسريباً متبقياً يقترب من الصفر عند دمجها مع الخصوصية التفاضلية مقارنة بالدفاعات الحالية.