Evaluating Stochastic Collapse and Implicit Bias in Multimodal Large Language Models
यह शोधपत्र RandomBench प्रस्तुत करता है, जो एक बेंचमार्क और मेट्रिक्स का एक सेट है जो तर्क-तटस्थ (logic-neutral) परिदृश्यों में वितरण रूप से तटस्थ व्यवहार बनाए रखने की मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, जो "स्टोकेस्टिक कोलैप्स" (Stochastic Collapse) नामक एक व्यापक घटना को उजागर करता है जहाँ मॉडल गहरा अंतर्निहित पूर्वाग्रह प्रदर्शित करते हैं और स्पष्ट रूप से निर्देश दिए जाने पर भी समान यादृच्छिकता (uniform randomness) उत्पन्न करने में विफल रहते हैं।