Comparing AI Agents to Cybersecurity Professionals in Real-World Penetration Testing
تقدم هذه الورقة أول تقييم شامل لوكلاء الذكاء الاصطناعي مقابل متخصصين بشريين في مجال الأمن السيبراني في بيئة مؤسسية حية، حيث أثبت إطار العمل متعدد الوكلاء المقترح ARTEMIS تفوقه على تسعة من أصل عشرة مشاركين بشريين في اكتشاف الثغرات الأمنية الصالحة مع تقديم مزايا كبيرة من حيث التكلفة، رغم القيود الحالية في التعامل مع المهام القائمة على واجهة المستخدم الرسومية (GUI) وارتفاع معدلات الإيجابيات الكاذبة.