A Multi-Agent Framework for Explainable Prompt Injection Detection in Large Language Models
यह शोध पत्र प्रॉम्प्टशील्ड (PromptShield) को प्रस्तुत करता है, जो एक व्याख्यात्मक मल्टी-एजेंट फ्रेमवर्क है जो बड़े भाषा मॉडलों (LLMs) में प्रॉम्प्ट इंजेक्शन हमलों का प्रभावी ढंग से पता लगाने और उन्हें समझाने के लिए SHAP और LIME जैसी XAI तकनीकों के साथ ट्रांसफॉर्मर-आधारित सिमेंटिक विश्लेषण को जोड़ता है।