GuardPhish: Securing Open-Source LLMs from Phishing Abuse
تقدم هذه الورقة GuardPhish، وهو مجموعة بيانات تصيد احتيالي متعددة المتجهات واسعة النطاق ومصنف معياري قائم على المحولات يكشف عن فجوة حرجة في النماذج اللغوية الكبيرة مفتوحة المصدر حيث يفشل اكتشاف النية العالية في منع توليد المحتوى، مما يقدم حلاً قابلاً للنشر لتأمين هذه النماذج ضد هجمات الهندسة الاجتماعية.