The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models
تقدم هذه الورقة مفهوم "اللاوعي الخوارزمي" لتجادل بأن التحيزات الكبيرة في النماذج اللغوية الكبيرة لا تنشأ مجرد من تكوين مجموعات البيانات، بل من آليات هيكلية متأصلة مثل التجزئة (tokenization)، والانتباه (attention)، والمحاذاة (alignment)، مبرهنةً من خلال التحليل التجريبي لفرط التجزئة في اللغة العربية كيف تعمل هذه العوامل البنيوية على تشويه أداء النموذج بشكل منهجي وتستوجب إطاراً جديداً للتدقيق التقني.