Differentially Private Preference Data Synthesis for Large Language Model Alignment
تقدم هذه الورقة DPPrefSyn، وهو أول إطار عمل لتوليد بيانات تفضيل اصطناعية ذات خصوصية تفاضلية لمحاذاة النماذج اللغوية الكبيرة من خلال تعلم نموذج برادلي-تيري خاص باستخدام تحليل المكونات الرئيسية ذو الخصوصية التفاضلية (DP-PCA) والاستفادة من المطالبات العامة للحفاظ على القيم البشرية دون المساس بخصوصية المستخدم.