TextCloak: Thwarting Unauthorized LLM Exploitation via RL-Driven Unlearnable Text
يُعد TextCloak إطار عمل مدفوعاً بالتعلم المعزز (RL) يحمي البيانات النصية من الاستغلال غير المصرح به من قبل النماذج اللغوية الكبيرة (LLMs) عبر استخدام سياسة توليدية مُحسّنة بواسطة خوارزمية GRPO-UE لإنشاء أمثلة غير قابلة للتعلم تعمل على إضعاف أداء الضبط الدقيق للنماذج مع الحفاظ على الأمانة الدلالية والطبيعية اللغوية.