💬 NLP

LLM-Oriented Information Retrieval: A Denoising-First Perspective

تجادل هذه الورقة المنظورية بأنه مع استهلاك النماذج اللغوية الكبيرة للمعلومات المسترجعة بشكل متزايد، ينتقل عنق الزجاجة الرئيسي في استرجاع المعلومات نحو تعظيم كثافة الأدلة وقابلية التحقق من خلال نهج يعطي الأولوية لإزالة الضجيج أولاً، وهو ما يتم معالجته عبر إطار عمل تحدي مكون من أربع مراحل وتصنيف شامل لتقنيات تحسين نسبة الإشارة إلى الضجيج عبر مسار الاسترجاع.

Lu Dai, Liang Sun, Fanpu Cao, Ziyang Rao, Cehao Yang, Hao Liu, Hui Xiong2026-05-04
💬 NLP

Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue

تُبين هذه الورقة أن نمذجة إنتاج المنطوق بوصفها خياراً احتماليًا حساسًا للتكلفة من بين بدائل موجهة نحو الأهداف ومولدة بواسطة نموذج لغوي، يكشف أن تقليل المفاجأة بالنسبة لهذه البدائل هو أقوى مؤشر لخيارات المتحدث في الحوار، متفوقًا بذلك على كثافة المعلومات الموحدة والتكاليف القائمة على الطول.

Tom Utting, Mario Giulianelli, Arabella Sinclair2026-05-04
💬 NLP

ControBench: An Interaction-Aware Benchmark for Controversial Discourse Analysis on Social Networks

تقدم هذه الورقة ControBench، وهو معيار مرجعي جديد لتحليل الخطاب المثير للجدل يدمج رسوم التفاعل الاجتماعي غير المتجانسة مع دلالات نصية غنية وأيديولوجيات المستخدمين المعلنة ذاتياً من Reddit لتمكين التقييم الواقعي للنماذج حول مواضيع مثل ترامب، والإجهاض، والدين.

Ta Thanh Thuy, Jiaqi Zhu, Xuan Liu, Lin Shang, Reihaneh Rabbany, Guillaume Rabusseau, Lihui Chen, Zheng Yilun, Sitao Lua (…)2026-05-04
💬 NLP

AGoQ: Activation and Gradient Quantization for Memory-Efficient Distributed Training of LLMs

تقدم الورقة البحثية AGoQ، وهو إطار عمل لتوزيع التدريب على النماذج اللغوية الكبيرة يتميز بكفاءة الذاكرة، والذي يستخدم تكميم التنشيط المدرك للطبقات وتكميم التدرج بـ 8 بت المحافظ على الدقة لتقليل استخدام الذاكرة بنسبة تصل إلى 52% وتسريع سرعة التدريب بمقدار 1.34 ضعفًا مع الحفاظ على تقارب النموذج ودقته.

Wenxiang Lin, Juntao Huang, Luhan Zhang, Laili Li, Xiang Bao, Mengyang Zhang, Bing Wang, Shaohuai Shi2026-05-04
💬 NLP

Structure Liberates: How Constrained Sensemaking Produces More Novel Research Output

تقدم الورقة البحثية إطار عمل SCISENSE، الذي يستفيد من مسارات التفكير الموجهة بالاستشهادات والمهيكلة لتدريب النماذج اللغوية الكبيرة، مما يثبت أن صياغة المعنى المقيدة تعزز بشكل مفاجئ كلاً من الجدة وجودة مخرجات الأبحاث عن طريق تقليل العبء المعرفي على الوكلاء اللاحقين.

James Mooney, Zae Myung Kim, Young-Jun Lee, Dongyeop Kang2026-05-04
💬 NLP

Beyond Decodability: Reconstructing Language Model Representations with an Encoding Probe

تقدم هذه الورقة "مسبار ترميز" (Encoding Probe) يعيد بناء تمثيلات النماذج اللغوية من سمات قابلة للتفسير، مما يقدم منظوراً مكملاً لمسابير فك التشفين التقليدية عبر تمكين المقارنة المباشرة بين السمات والكشف عن كيفية مساهمة السمات اللغوية والصوتية المختلفة في الحالات الداخلية للنموذج.

Gaofei Shen, Martijn Bentum, Tom Lentz, Afra Alishahi, Grzegorz Chrupała2026-05-04
💬 NLP

SC-Taxo: Hierarchical Taxonomy Generation under Semantic Consistency Constraints using Large Language Models

تقترح الورقة البحثية SC-Taxo، وهو إطار عمل يستفيد من النماذج اللغوية الكبيرة مع آلية توليد عناوين ثنائية الاتجاه لمعالجة عدم الاتساق الهيكلي وعدم المحاذاة الدلالية في توليد التصنيفات العلمية من خلال ضمان الاتساق الدلالي الهرمي.

Shiqiang Cai, Nianhong Niu, Shizhu He, Kang Liu, Jun Zhao2026-05-04
💬 NLP

Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs

تقدم هذه الورقة MathArena، وهي منصة تقييم مستمرة الصيانة تتوسع لما وراء المعايير المرجعية الثابتة لتقييم النماذج اللغوية الكبيرة بشكل شامل عبر مهام رياضية متنوعة — بما في ذلك مسائل الأولمبياد، والأسئلة على مستوى الأبحاث، والبراهين الرسمية — مما يثبت أن النماذج الرائدة مثل GPT-5.5 يمكنها الآن حل مشكلات رياضية بالغة الصعوبة مع تسليط الضوء على ضرورة وجود أنظمة تقييم ديناميكية لتتبع التقدم السريع.

Jasper Dekoninck, Nikola Jovanović, Tim Gehrunger, Kári Rögnvalddson, Ivo Petrov, Chenhao Sun, Martin Vechev2026-05-04
💬 NLP

Characterizing the Expressivity of Local Attention in Transformers

تقدم هذه الورقة تفسيراً نظرياً رسمياً لتحسن جودة الانتباه المحلي في نماذج المحولات (transformers) من خلال إثبات أنها توسع بشكل صارم قدرة النموذج التعبيرية على اللغات المنتظمة عبر إضافة عامل زمني ثانٍ، وهو استنتاج أكدته التجارب التي أظهرت أن البنى الهجينة (عالمية-محلية) تتفوق على النماذج العالمية فقط.

Jiaoda Li, Ryan Cotterell2026-05-04
💬 NLP

Directed Social Regard: Surfacing Targeted Advocacy, Opposition, Aid, Harms, and Victimization in Online Media

تقدم هذه الورقة "الاعتبار الاجتماعي الموجه" (DSR)، وهو إطار عمل جديد لتحليل المشاعر متعدد الأبعاد يستخدم نماذج قائمة على المحولات لتحديد أهداف المشاعر وتقييمها في آن واحد عبر ثلاثة محاور للاعتبار الاجتماعي، مما يتيح رصد التعايش بين المشاعر المؤيدة والمناهضة للمجتمع في وسائل الإعلام عبر الإنترنت والتي تغفل عنها الأدوات التقليدية.

Scott Friedman, Ruta Wheelock, Sonja Schmer-Galunder, Drisana Iverson, Jake Vasilakes, Joan Zheng, Jeffrey Rye, Vasanth (…)2026-05-04