The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models
यह शोध पत्र "एल्गोरिद्मिक अचेतन" (algorithmic unconscious) की अवधारणा प्रस्तुत करता है ताकि यह तर्क दिया जा सके कि बड़े भाषा मॉडलों में महत्वपूर्ण पूर्वाग्रह केवल डेटासेट की संरचना से ही नहीं, बल्कि टोकनाइज़ेशन, अटेंशन और एलाइनमेंट जैसी अंतर्निहित संरचनात्मक प्रणालियों से उत्पन्न होते हैं, जो अरबी भाषा के ओवर-सेगमेंटेशन के अनुभवजन्य विश्लेषण के माध्यम से यह प्रदर्शित करता है कि कैसे ये ढांचागत कारक व्यवस्थित रूप से मॉडल के प्रदर्शन को विकृत करते हैं और तकनीकी ऑडिटिंग के लिए एक नए ढांचे की आवश्यकता को अनिवार्य बनाते हैं।