Instruction Complexity Induces Positional Collapse in Adversarial LLM Evaluation
यह शोध पत्र यह प्रदर्शित करता है कि प्रतिकूल निर्देशों (adversarial instructions) की जटिलता यह निर्धारित करती है कि क्या निर्देश-ट्यून किए गए LLMs प्रश्न की सामग्री के साथ जुड़ते हैं या स्थितिगत शॉर्टकट (positional shortcuts) का सहारा लेते हैं, जो यह प्रकट करता है कि अत्यधिक जटिल, बहु-चरणीय परिहार निर्देश (avoidance instructions) चरम "पोजीशनल कोलैप्स" (positional collapse) को ट्रिगर करते हैं जहाँ मॉडल विशिष्ट उत्तर स्थितियों पर डिफ़ॉल्ट करने के लिए सामग्री को पूरी तरह से अनदेखा कर देते हैं।