💬 NLP

Control Illusion: The Failure of Instruction Hierarchies in Large Language Models

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تفشل في فرض مخططات التعليمات الهرمية بشكل موثوق، حيث يتأثر سلوكها بالمنطلقات الاجتماعية الكامنة المستمدة من مرحلة ما قبل التدريب أكثر من تأثره بالتمايز الصريح بين أدوار النظام والمستخدم.

Yilin Geng, Haonan Li, Honglin Mu, Xudong Han, Timothy Baldwin, Omri Abend, Eduard Hovy, Lea Frermann2026-03-23
💬 NLP

Improved Generalized Planning with LLMs through Strategy Refinement and Reflection

تقدم هذه الورقة إطار عمل محسّنًا للتخطيط العام القائم على النماذج اللغوية الكبيرة (LLM) يعزز جودة الخطط من خلال إدخال تحسين الاستراتيجية القائم على الكود الزائف مع التصحيح التلقائي للأخطاء، ودمج التأمل لتشخيص الإخفاقات، وتوليد متغيرات برمجية متعددة، محققًا متوسط تغطية بنسبة 82% عبر 17 مجالًا مرجعيًا.

Katharina Stein, Nils Hodel, Daniel Fišer, Jörg Hoffmann, Michael Katz, Alexander Koller2026-03-23
💬 NLP

LiRA: A Multi-Agent Framework for Reliable and Readable Literature Review Generation

تُعد LiRA إطار عمل متعدد الوكلاء يحاكي عملية مراجعة الأدبيات البشرية من خلال وكلاء متخصصين متعاونين لإنتاج مراجعات علمية موثوقة، وسلسة القراءة، ودقيقة واقعياً، متفوقةً بذلك على النماذج المرجعية الحالية في جودة الكتابة والاستشهاد.

Gregory Hok Tjoan Go, Khang Ly, Anders Søgaard, Amin Tabatabaei, Maarten de Rijke, Xinyi Chen2026-03-23
💬 NLP

Can AI Truly Represent Your Voice in Deliberations? A Comprehensive Study of Large-Scale Opinion Aggregation with LLMs

تقدم هذه الورقة DeliberationBank، وهي مجموعة بيانات ضخمة مشروحة بشرياً، وDeliberationJudge، وهو نموذج مضبوط بدقة يتفوق على النماذج اللغوية الكبيرة في تقييم ملخصات المداولات، وذلك لتحديد ومعالجة التحيزات المستمرة بشكل منهجي، مثل نقص تمثيل وجهات نظر الأقليات في المداولات العامة التي يقودها الذكاء الاصطناعي.

Shenzhe Zhu, Shu Yang, Michiel A. Bakker, Alex Pentland, Jiaxin Pei2026-03-23
💬 NLP

Modeling Turn-Taking with Semantically Informed Gestures

تقدم هذه الورقة مجموعة بيانات DnD Gesture++ التي تحتوي على 2,663 تعليقاً دلالياً للإيماءات، وتثبت أن إطار عمل "خليط من الخبراء" (Mixture-of-Experts) الذي يدمج هذه الإيماءات المعلوماتية دلالياً يحسن بشكل كبير التنبؤ بتناوب الأدوار متعدد الوسائط مقارنة بالنماذج المرجعية التي تعتمد فقط على النصوص والصوت.

Varsha Suresh, M. Hamza Mughal, Christian Theobalt, Vera Demberg2026-03-23
💬 NLP

BitSkip: An Empirical Analysis of Quantization and Early Exit Composition in Transformers

تقدم هذه الورقة إطار عمل BitSkip، الذي يكشف أن نموذجاً بسيطاً مكمماً بـ 8 بت بدون تحويلات هادامارد يتفوق على نظائره المعقدة ذات الـ 4 بت والمعززة بهادامارد، مع تحقيق مكاسب كبيرة في السرعة من خلال استراتيجيات الخروج المبكر المثلى.

Ramshankar Bhuvaneswaran, Handan Liu2026-03-23
💬 NLP

Rep2Text: Decoding Full Text from a Single LLM Token Representation

يقدم البحث إطار عمل Rep2Text، الذي يقوم بفك تشفير النص الأصي المدخل من تمثيل الرمز الأخير (last-token representation) الوحيد للنماذج اللغوية الكبيرة باستخدام محول (adapter) قابل للتدريب، موضحاً أنه في حين ينخفض استرداد مستوى الرمز مع طول التسلسل، إلا أن التماسك الدلالي يظل قوياً عبر مختلف النماذج والبيانات الخارجة عن نطاق التوزيع.

Haiyan Zhao, Zirui He, Yiming Tang, Fan Yang, Ali Payani, Dianbo Liu, Mengnan Du2026-03-23
💬 NLP

L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent Intervention

تقترح الورقة البحثية L2V-CoT، وهي طريقة لا تتطلب تدريباً تعمل على تعزيز قدرات الاستنتاج في نماذج الرؤية واللغة عبر نقل تمثيلات "سلسلة الأفكار" (Chain-of-Thought) من النماذج اللغوية الكبيرة عبر التدخل الكامن في نطاق التردد، مستفيدةً من بنياتها الكامنة المشتركة ذات التردد المنخفض دون الحاجة إلى محاذاة معمارية أو تدريب مكثف.

Yuliang Zhan, Xinyu Tang, Han Wan, Jian Li, Ji-Rong Wen, Hao Sun2026-03-23
💬 NLP

Dementia-R1: Reinforced Pretraining and Reasoning from Unstructured Clinical Notes for Real-World Dementia Prognosis

يُعد Dementia-R1 إطار عمل للتعلم التعزيزي يستفيد من التدريب المسبق للبداية الباردة على مؤشرات سريرية قابلة للتحقق لتمكين النماذج اللغوية الكبيرة من التفكير بفعالية في مسارات الأعراض غير الرتيبة والمعقدة من أجل التنبؤ الطولي الدقيق بالخرف من الملاحظات السريرية غير المهيكلة.

Choonghan Kim, Hyunmin Hwang, Hangeol Chang, Jaemin Kim, Jinse Park, Jae-Sung Lim, Jong Chul Ye2026-03-23
💬 NLP

Identifying and Mitigating Bottlenecks in Role-Playing Agents: A Systematic Study of Disentangling Character Profile Axes

تقدم هذه الورقة إطاراً تشخيصياً منهجياً لتحليل محاور ملفات تعريف الشخصيات في وكلاء تقمص الأدوار القائمين على النماذج اللغوية الكبيرة، كاشفةً أن أولويات المحاذاة تضعف الأداء بشكل كبير للشخصيات غير الأخلاقية عبر كبح الرموز المتعلقة بالدوافع، وتقترح استراتيجية فك تشفير تبايني مدركة للمجال (FACD) خالية من التدريب للتخفيف بفعالية من هذه العقبة.

Yonghyun Jun, Junhyuk Choi, Jihyeong Park, Jeonghyun Park, Liu Nicole Geumheon, Hwanhee Lee2026-03-23