💬 NLP

Diverging Transformer Predictions for Human Sentence Processing: A Comprehensive Analysis of Agreement Attraction Effects

تقيم هذه الورقة أحد عشر نموذجاً من نماذج المحولات ذاتية الانحدار (autoregressive transformers) في تكوينات جذب المطابقة (agreement attraction) في اللغة الإنجليزية باستخدام آلية ربط قائمة على المفاجأة (surprisal-based linking)، وتجد أنه بينما تتوافق هذه النماذج مع أوقات القراءة البشرية في هياكل الجمل المجرورة بحروف الجر، فإنها تفشل في محاكاة أنماط التداخل البشرية في جمل الصلة المستخرجة من المفعول به، لتخلص إلى أن النماذج الحالية لا تفسر المعالجة النحوية الصرفية البشرية بشكل كافٍ.

Titus von der Malsburg, Sebastian Padó2026-03-18
🤖 machine learning

When and Why Does Unsupervised RL Succeed in Mathematical Reasoning? A Manifold Envelopment Perspective

تتقصى هذه الورقة حدود النجاح والفشل للتعلم التعزيزي غير الخاضع للإشراف في مجال الاستدلال الرياضي، وذلك عبر تصميم مكافآت ذاتية للتوليد الموجز، وتحديد الأولويات المنطقية التأسيسية كمحددات حاسمة للاستقرار، وتقديم منظور هندسي جديد لـ "التغليف المانيفولدي" (manifold envelopment) لتشخيص الأسباب التي تجعل تكوينات معينة تستقر بينما تنهار أخرى.

Zelin Zhang, Fei Cheng, Chenhui Chu2026-03-18
💬 NLP

Tarab: A Multi-Dialect Corpus of Arabic Lyrics and Poetry

تقدم الورقة البحثية "طرب"، وهو متن مفتوح واسع النطاق يضم ٢.٥٦ مليون بيت من كلمات الأغاني والشعر العربي الممتد عبر أربعة عشر قرناً وعدة لهجات، صُمم لتسهيل التحليل اللغوي والأسلوبي المقارن من خلال البيانات الوصفية المهيكلة والأدوات التحليلية المرجعية.

Mo El-Haj2026-03-18
💬 NLP

Can Linguistically Related Languages Guide LLM Translation in Low-Resource Settings?

تتقصى هذه الورقة ما إذا كان استخدام لغات وسيطة ذات صلة لغوية ونماذج توضيحية قليلة العينات يمكن أن يوجه النماذج اللغوية الكبيرة في الترجمة الآلية للغات ذات الموارد المحدودة دون تحديث المعلمات، وتجد أنه في حين يوفر هذا النوع من التلقين أثناء الاستدلال تحسينات متواضعة للغات ضعيفة التمثيل، إلا أن فعاليته غالباً ما تكون غير متسقة وحساسة للغاية لطريقة بناء الأمثلة.

Aishwarya Ramasethu, Niyathi Allu, Rohin Garg, Harshwardhan Fartale, Dun Li Chan2026-03-18
💬 NLP

Retrieving Counterfactuals Improves Visual In-Context Learning

تقدم الورقة البحثية CIRCLES، وهو إطار عمل مبتكر يعزز التعلم في السياق لنماذج الرؤية واللغة من خلال الاسترجاع النشط لأمثلة بأسلوب التناقض عبر استرجاع الصور المركبة الموجهة بالسمات، مما يتيح استدلالاً سببياً أكثر قوة ويتفوق على الأساليب الحالية القائمة على التشابه عبر مجموعات بيانات متنوعة.

Guangzhi Xiong, Sanchit Sinha, Zhenghao He, Aidong Zhang2026-03-18
💬 NLP

TurnWise: The Gap between Single- and Multi-turn Language Model Capabilities

تقدم هذه الورقة المعيار المرجعي TurnWiseEval ومسار البيانات الاصطناعية TurnWiseData لمعالجة الفجوة بين قدرات النماذج اللغوية في المحادثات أحادية ومتعددة الأدوار، مما يثبت أن دمج 10,000 محادثة متعددة الأدوار فقط خلال مرحلة ما بعد التدريب يحسن الأداء متعدد الأدوار بشكل كبير.

Victoria Graf, Valentina Pyatkin, Nouha Dziri, Nathan Lambert, Hannaneh Hajishirzi2026-03-18
🤖 AI

Is Conformal Factuality for RAG-based LLMs Robust? Novel Metrics and Systematic Insights

تقيم هذه الورقة البحثية بشكل منهجي واقعية المطابقة للنماذج اللغوية الكبيرة القائمة على التوليد المعزز بالاسترداد (RAG)، كاشفةً عن مقايضات جوهرية بين الموثوقية والإخبارية، والهشاشة تحت تأثير تحولات التوزيع، والكفاءة المتفوقة للمحققات خفيفة الوزن القائمة على الاستلزام مقارنة بالمقومات القائمة على النماذج اللغوية الكبيرة، مما يسلط الضوء على الحاجة إلى نهج جديدة قوية لضمان كل من الموثوقية والفائدة في التطبيقات كثيفة المعرفة.

Yi Chen, Daiwei Chen, Sukrut Madhav Chikodikar, Caitlyn Heqi Yin, Ramya Korlakai Vinayak2026-03-18
🤖 AI

Prompt Programming for Cultural Bias and Alignment of Large Language Models

تؤكد هذه الورقة استمرارية التحيزات الثقافية في النماذج اللغوية الكبيرة ذات الأوزان المفتوحة، وتثبت أن استخدام DSPy لتحسين المطالبات كبرامج نمطية يوفر نهجاً أكثر استقراراً وقابلية للنقل لتحقيق التوافق الثقافي مقارنة بهندسة المطالبات اليدوية.

Maksim Eren, Eric Michalak, Brian Cook, Johnny Seales Jr2026-03-18
💬 NLP

Mediocrity is the key for LLM as a Judge Anchor Selection

تُثبت هذه الورقة أن اختيار النموذج المرجعي أمر بالغ الأهمية لموثوقية تقييمات "النماذج اللغوية الكبيرة كحَكَم"، حيث تكشف أن النماذج المرجعية المتطرفة (الأفضل أو الأسوأ) تُضعف دقة التصنيف، وتدعو إلى استخدام نماذج مرجعية "متوسطة" إلى جانب أحجام أكبر للمقارنات المعيارية لضمان نتائج قوية.

Shachar Don-Yehiya, Asaf Yehudai, Leshem Choshen, Omri Abend2026-03-18
💬 NLP

Chronos: Temporal-Aware Conversational Agents with Structured Event Retrieval for Long-Term Memory

تقدم الورقة البحثية Chronos، وهو إطار عمل مبتكر للذاكرة المدركة زمنياً يقوم بهيكلة الحوار في أزواج أحداث (event tuples) ويستخدم التلقين الديناميكي مع استدعاء الأدوات المتكرر لتحقيق أداء رائد في مهام الذاكرة الحوارية طويلة المدى.

Sahil Sen, Elias Lumer, Anmol Gulati, Vamse Kumar Subbiah2026-03-18