Position: AI Security Policy Should Target Systems, Not Models
यह शोध पत्र "स्वार्म-अटैक" (swarm-attack) का परिचय देता है, जो एक ओपन-सोर्स फ्रेमवर्क है और यह प्रदर्शित करता है कि एक परिष्कृत सिस्टम स्कैफोल्ड के माध्यम से समन्वित कई हल्के, कमोडिटी एलएलएम (LLM) एजेंट, फ्रंटियर मॉडल्स के सुरक्षा गार्डरेल्स को प्रभावी ढंग से बायपास करने और लगभग शून्य लागत पर सॉफ्टवेयर कमजोरियों को खोजने में सक्षम हैं, और यह तर्क देता है कि एआई (AI) सुरक्षा नीति को व्यक्तिगत मॉडलों के बजाय इन सिस्टम आर्किटेक्चर को लक्षित करना चाहिए।