Vectors Are Not Neutral: Sensitive-Information Inference from Exported LLM Representations in Summarization
تُثبت هذه الورقة أن التمثيلات المتجهية المدمجة المصدرة من أنظمة تلخيص النماذج اللغوية الكبيرة يمكن أن تسرب معلومات حساسة مثل عرق المريض حتى عندما تكون الوثائق المصدرية مقيدة، وتُظهر أن استراتيجيات التخفيف مثل SurfaceLoRA يجب أن تستهدف بدقة الأثر المتجهي المكشوف بعينه لمنع مثل هذا الاستنتاج بفعالية دون المساس بالمنفعة.