💬 NLP

Barriers to Discrete Reasoning with Transformers: A Survey Across Depth, Exactness, and Bandwidth

تُجمّع هذه الدراسة الاستقصائية الرؤى المستمدة من تعقيد الدوائر، ونظرية التقريب، وتعقيد الاتصال لتوضيح العوائق الهيكلية والحسابية الجوهرية التي تمنع بنيات المحولات (transformer architectures) من أداء مهام الاستدلال المنطقي المتقطع بدقة، مع تقديم دلالات لتصميم النماذج المستقبلية.

Michelle Yuan, Weiyi Sun, Amir H. Rezaeian, Jyotika Singh, Sandip Ghoshal, Yao-Ting Wang, Miguel Ballesteros, Yassine Be (…)2026-02-13
💬 NLP

From Instruction to Output: The Role of Prompting in Modern NLG

تتناول هذه الدراسة غياب إطار عمل مهيكل لهندسة الأوامر في توليد اللغة الطبيعية من خلال تقديم تصنيف شامل، ودليل اتخاذ قرار للممارسين، وإطار عمل موحد يربط بين التصميم والتحسين والتقييم لتعزيز القدرة على التحكم والتعميم في النماذج اللغوية الكبيرة.

Munazza Zaib, Elaf Alhazmi2026-02-13
💬 NLP

Mechanistic Interpretability for Large Language Model Alignment: Progress, Challenges, and Future Directions

تستعرض هذه الورقة التقدم والتحديات والتوجهات المستقبلية للتفسير الآلي كإطار عمل حاسم لفهم نماذج اللغات الكبيرة ومواءمتها، مع تسليط الضوء على دوره في توجيه استراتيجيات مثل التعلم المعزز من التغذية الراجعة البشرية (RLHF) مع معالجة عقبات مثل تعدد المعاني والتراكب.

Usman Naseem2026-02-13
💬 NLP

SurveyLens: A Research Discipline-Aware Benchmark for Automatic Survey Generation

تقدم هذه الورقة البحثية SurveyLens، وهو أول معيار مرجعي مدرك للتخصصات وإطار تقييم ثنائي العدسات مصمم لتقييم وتوجيه استخدام أساليب التوليد التلقائي للمسوحات عبر مختلف المجالات الأكاديمية، مما يعالج أوجه القصور في المقاييس الحالية المنحازة لعلوم الحاسوب ومعايير التقييم العامة.

Beichen Guo, Zhiyuan Wen, Jia Gu, Senzhang Wang, Haochen Shi, Ruosong Yang, Shuaiqi Liu2026-02-13
💬 NLP

How Many Features Can a Language Model Store Under the Linear Representation Hypothesis?

تضع هذه الورقة حدوداً نظرية تقترب من التطابق، تُظهر أنه في حين أن إمكانية الوصول الخطي تُعد قيداً أقوى بكثير من مجرد التمثيل الخطي، إلا أنه لا يزال بإمكان عصبونات النماذج اللغوية تخزين عدد أسي من الميزات بموجب فرضية التمثيل الخطي.

Nikhil Garg, Jon Kleinberg, Kenny Peng2026-02-13
💬 NLP

Are Aligned Large Language Models Still Misaligned?

تقدم هذه الورقة البحثية Mis-Align Bench، وهو معيار موحد ومجموعة بيانات SAVACU التي تضم أكثر من 382,000 عينة، لتقييم عدم توافق النماذج اللغوية الكبيرة عبر أبعاد السلامة والقيم والثقافة في آن واحد، مما يكشف أن النماذج المُحسّنة لأبعاد منفردة تعاني من معدلات فشل كاذب عالية وانخفاض في درجات التوافق عند مواجهة ظروف واقعية مشتركة.

Usman Naseem, Gautam Siddharth Kashyap, Rafiq Ali, Ebad Shabbir, Sushant Kumar Ray, Abdullah Mohammad, Agrima Seth2026-02-13
💬 NLP

Evaluating Alignment of Behavioral Dispositions in LLMs

تقدم هذه الورقة إطار عمل يستخدم اختبارات الحكم الموقفي لتقييم مدى توافق الاستعدادات السلوكية للنماذج اللغوية الكبيرة مع التفضيلات البشرية، مما يكشف عن أن النماذج غالباً ما تظهر ثقة مفرطة، وتتباعد عن الإجماع البشري، وتُظهر فجوات بين قيمها المعلنة وسلوكياتها المكشوفة.

Amir Taubenfeld, Zorik Gekhman, Lior Nezry, Omri Feldman, Natalie Harris, Shashir Reddy, Romina Stella, Ariel Goldstein (…)2026-02-13
💬 NLP

Finding the Cracks: Improving LLMs Reasoning with Paraphrastic Probing and Consistency Verification

تقترح الورقة إطار عمل "الاستقصاء عبر إعادة الصياغة والتحقق من الاتساق" (PPCV)، وهو منهج ذو مرحلتين يحدد رموز الاستدلال الحرجة من خلال الاستقصاء عبر إعادة الصياغة، ويعمل على تحسين أداء النماذج اللغوية الكبيرة عن طريق استبدال هذه الرموز والتحقق من الاتساق عبر مسارات الاستدلال المتوازية.

Weili Shi, Dongliang Guo, Lehan Yang, Tianlong Wang, Hanzhang Yuan, Sheng Li2026-02-13
💬 NLP

Sparse Semantic Dimension as a Generalization Certificate for LLMs

تقترح هذه الورقة البحثية "البعد الدلالي المتناثر" (SSD)، وهو مقياس للتعقيد يعتمد على سمات المشفّر التلقائي المتناثر، لتفسير التعميم القوي للنماذج اللغوية الكبيرة من خلال إثبات أن سعتها الفعالة تكمن في متشعب متناثر منخفض الأبعاد بدلاً من إجمالي عدد المعلمات، مع الكشف أيضاً عن أن النماذج الأكبر تتعلم هياكل أكثر قابلية للضغط، وأن الانحرافات عن هذا المتشعب تعمل كمؤشرات موثوقة للمدخلات الخارجة عن نطاق التوزيع.

Dibyanayan Bandyopadhyay, Asif Ekbal2026-02-13
💬 NLP

Gradients Must Earn Their Influence: Unifying SFT with Generalized Entropic Objectives

تقدم هذه الورقة البحثية "الضبط الدقيق للإنتروبيا الديناميكية" (DEFT)، وهو هدف خالٍ من المعلمات يوحد الضبط الدقيق الموجه (SFT) مع أهداف إنتروبية معممة عبر تعديل الثقة في التدرج ديناميكياً بناءً على عدم اليقين التنبؤي لحل معضلة المرونة والاستقرار وتحسين أداء النموذج.

Zecheng Wang, Deyuan Liu, Chunshan Li, Yupeng Zhang, Zhengyun Zhao, Dianhui Chu, Bingning Wang, Dianbo Sui2026-02-13