Comparing AI Agents to Cybersecurity Professionals in Real-World Penetration Testing
यह शोध पत्र एक लाइव एंटरप्राइज वातावरण में मानव साइबर सुरक्षा पेशेवरों के विरुद्ध एआई एजेंटों का पहला व्यापक मूल्यांकन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि प्रस्तावित मल्टी-एजेंट फ्रेमवर्क ARTEMIS ने वैध कमजोरियों को खोजने में दस में से नौ मानव प्रतिभागियों को पीछे छोड़ दिया और GUI-आधारित कार्यों को संभालने में वर्तमान सीमाओं और उच्च फाल्स-पॉजिटिव दरों के बावजूद महत्वपूर्ण लागत लाभ प्रदान किए।