Vision-Language Models Suppress Female Representations Under Ambiguous Input
यह शोध पत्र यह प्रकट करता है कि जहाँ विजन-लैंग्वेज मॉडल अक्सर अस्पष्ट छवियों के लिए आंतरिक रूप से महिला संघों को एनकोड करते हैं, वहीं उनके आउटपुट व्यवस्थित रूप से पुरुष निरूपणों की ओर डिफ़ॉल्ट होते हैं क्योंकि एक विषम फ़िल्टरिंग तंत्र जनरेशन के दौरान पुरुष संकेतों को बढ़ाता है और महिला संकेतों को दबा देता है।