GradingAttack: Exposing Security Vulnerabilities in LLM Based Educational Grading Agents
यह शोध पत्र GradingAttack को प्रस्तुत करता है, जो एक सूक्ष्म (fine-grained) एडवरसेरियल फ्रेमवर्क है जो यह प्रदर्शित करता है कि कैसे टोकन-स्तरीय और प्रॉम्प्ट-स्तरीय हेरफेर प्रभावी ढंग से और गुप्त रूप से LLM-आधारित शैक्षिक ग्रेडिंग एजेंटों की सुरक्षा से समझौता कर सकते हैं, जो स्वचालित मूल्यांकन प्रणालियों में मजबूत सुरक्षा उपायों की तत्काल आवश्यकता को रेखांकित करता है।