💻 computer science

A Declarative-Procedural Perspective on Expert Routing in Bilingual Mixture-of-Experts Language Models

تُظهر هذه الدراسة أنه بينما تُبدي نماذج "خليط الخبراء" ثنائية اللغة المدربة على بيانات مختلطة تخصصاً إجمالياً أقوى للخبراء، فإن تلك المدربة عبر تعريض منهجي متسلسل تطور أنماط توجيه أكثر استقراراً وتوازناً لغوياً، مما يشير إلى أن الاكتساب الثنائي المتدرج يقلل من هيمنة اللغة الواحدة لصالح تنظيم هيكلي لغوي أكثر قابلية للتفسير.

Amrit Gopinath (Sri Sivasubramaniya Nadar College of Engineering, Chennai, India), Raghul (Sri Sivasubramaniya Nadar Co (…)2026-08-18
🤖 AI

Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models

تُثبت هذه الورقة أن انحيازات ترتيب الكلمات في النماذج اللغوية ذات فك التشفير فقط ليست تفضيلات هيكلية متأصلة، بل هي مدفوعة ببيانات التدريب، حيث تفضل النماذج هياكل (فاعل-فعل-مفعول به) ذات التفرع الأيمن في اللغات الطبيعية بسبب وفرة البيانات وجودتها، مما يشكل خطراً يتمثل في تقليل تنوع ترتيب الكلمات العالمي.

Varvara Arzt, Allan Hanbury, Terra Blevins2026-08-18
🤖 AI

Demographic Injection in Medical Language Models under Diversity, Equity, and Inclusion Prompts

تكشف هذه الدراسة أن إلحاق مطالبات التنوع والإنصاف والشمول (DEI) بالاستعلامات الطبية يتسبب في قيام النماذج اللغوية الكبيرة، بشكل متكرر وغير دقيق، باختلاق سمات ديموغرافية للمرضى لم تُطلب منها، وهي ظاهرة أُطلق عليها اسم "الحقن الديموغرافي" والتي تزيد بشكل كبير من معدل التوصيات السريرية غير الصحيحة عبر 47 نموذجاً.

Diego Mardian, Frank Liu2026-08-18
💻 computer science

Time as Structure: Temporal Dependency Graphs for Verifiable Deadline Computation over Legal Documents

تقترح هذه الورقة نهجاً هجيناً يستخرج التبعيات الزمنية من الوثائق القانونية إلى رسم بياني لحساب المواعيد النهائية القائم على الكود، مما يثبت أن هذا المسار يتفوق بشكل كبير على الإجابة المباشرة للنماذج اللغوية في الدقة والقابلية للتحقق، لا سيما من خلال تجنب الأخطاء الحسابية مع تسليط الضوء على أن عملية الاستخراج تظل المصدر الرئيسي للفشل.

Maryia Zhyrko, Lifeng Han, Suzan Verberne2026-08-18
💻 computer science

When Do Concepts Become Functionally Sufficient During Language-Model Training?

تقدم هذه الورقة إطاراً وظيفياً لتحديد متى تصبح المفاهيم الداخلية كافية أثناء تدريب النماذج اللغوية من خلال اختبار ما إذا كانت التنشيطات المتفرقة والمقنعة يمكنها الحفاظ على المعلومات المستهدفة عبر التدخلات عبر الطبقات ونقاط التحقق، مما يكشف أن الأقنعة اللاحقة تحتفظ بكتلة ناعمة أقل بكثير من أقنعة إعادة البناء رغم وجود تحولات طفيفة في التوزيع التنبؤي.

Raphael Bernas, Paul G. Chevalier, Fanny Jourdan, Céline Hudelot2026-08-18
🤖 AI

When AI Rewrites, Classifiers Relax: Uncertainty-Aware Sentiment Analysis on Sarcastic and AI-Paraphrased Social Text

تُظهر هذه الورقة أن مصنفات المشاعر تُبدي ثقةً أقل في النصوص الساخرة، وتحقق دقةً أعلى في المراجعات التي تمت إعادة صياغتها بواسطة الذكاء الاصطناعي بسبب التوافق الأسلوبي، ويمكنها تحسين الأداء العام بشكل كبير من خلال الامتناع الخفيف الواعي بعدم اليقين، مما يدعو إلى التحول نحو التنبؤ الواعي بعدم اليقين في التطبيقات عالية المخاطر.

Shresth Shroff2026-08-18
💻 computer science

The Machine's Internal Clock: Do LLMs Share Human Temporal Illusions?

تكشف هذه الدراسة أنه في حين يفشل القراء البشر عمومًا في إظهار أوهام زمنية محددة في السرديات النصية فقط، فإن النماذج اللغوية الكبيرة تتماشى بشكل مفاجئ مع الأوهام التي تنبأت بها الأدبيات، ويرجع ذلك على الأرجح إلى استرجاع الأبحاث النفسية بدلاً من محاكاة انحيازات زمنية بشرية حقيقية.

Catherine Bao, Vivek Srikumar2026-08-18
🤖 AI

Large Language Model Assisted Operational Monitoring for Battery Energy Storage System Integrated Power Distribution Networks

تقدم هذه الورقة إطار عمل للمراقبة مدعوماً بالذكاء الاصطناعي يسخر النماذج اللغوية الكبيرة لترجمة استعلامات المشغلين باللغة الطبيعية إلى أوامر SQL تم التحقق من صحتها لتحليل بيانات القياس عن بُعد لأنظمة تخزين طاقة البطاريات، مما يتيح الكشف الآلي عن انتهاكات الجهد، وتجاوزات القدرة غير الفعالة، وتتبع الأداء في شبكات التوزيع.

Azmeer Akhtar, Md Fazley Rafy, Anurag K. Srivastava2026-08-18
🤖 AI

Gated Against One Model, Open to the Next: Option-Only Solvability in Legal Multiple-Choice Benchmarks

تكشف هذه الورقة أن اختبارات الاختيار من متعدد القانونية، مثل UA-JudgeExam، غالباً ما يمكن للنماذج حلها باستخدام خيارات الإجابة فقط دون قراءة الأسئلة بسبب انحيازات موضع الخيارات وأنماط المشتتات القابلة للاستغلال، مما يستلزم وضع بوابات صارمة وإزالة الانحياز لتقييم قدرات الاستدلال القانوني الحقيقية بدقة.

Volodymyr Ovcharov2026-08-18