💬 NLP

SPQ: An Ensemble Technique for Large Language Model Compression

تقدم هذه الورقة البحثية تقنية SPQ، وهي تقنية ضغط تجميعية تجمع بشكل تآزري بين تفكيك القيم المفردة (SVD)، والتقليم القائم على التنشيط، وتكميم ما بعد التدريب لتحقيق خفض كبير في الذاكرة وتحسين سرعة الاستدلال للنماذج اللغوية الكبيرة مثل LLaMA-2-7B مع الحفاظ على مستويات الارتياب ودقة المهام اللاحقة أو تعزيزها مقارنة بالنماذج المرجعية الحالية.

Jiamin Yao, Eren Gultepe2026-02-23
💬 NLP

RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering

تقدم هذه الورقة إطار عمل "الاسترجاع-التحقق-الاسترجاع" (RVR)، وهو إطار عمل متعدد الجولات يعمل على تعزيز الاستعلامات بشكل تكراري بوثائق تم التحقق منها لتعظيم التغطية الشاملة للإجابة، مما يظهر تحسينات كبيرة في الاستدعاء مقارنة بالنماذج المرجعية الحالية عبر مجموعات بيانات متنوعة.

Deniz Qian, Hung-Ting Chen, Eunsol Choi2026-02-23
💬 NLP

The distribution of discourse relations within and across turns in spontaneous conversation

تُكيّف هذه الدراسة نظام علاقات الخطاب الخاص باللغة المكتوبة ليناسب الحوار العفوي باستخدام تعليقات توضيحية من مصادر جماعية لتوضيح أن توزيعات علاقات الخطاب تتباين بشكل كبير عبر السياقات الحوارية المختلفة، مع إظهار أن التعليقات التوضيحية أحادية الدور تقدم أكبر قدر من عدم اليقين، بينما تؤكد في الوقت ذات نفسه أن هذه التعليقات ذات جودة كافية ليتم التنبؤ بها من خلال تضمينات وحدات الخطاب.

S. Magalí López Cortez, Cassandra L. Jacobs2026-02-20
💬 NLP

Enhancing Multilingual LLM Pretraining with Model-Based Data Selection

تقدم هذه الورقة إطار عمل للترشيح القائم على النماذج يتسم بالشفافية والكفاءة لمجموعات البيانات متعددة اللغات، والذي يُمكّن نموذج لغوي كبير بمليار معلمة من مطابقة أداء النموذج المرجعي باستخدام 15% فقط من رموز التدريب عبر الاستفادة من مصنفات Transformer وFastText لاختيار عينات متنوعة وغنية معرفياً، مع التخفيف من حدة لعنة تعدد اللغات عبر 20 لغة.

Bettina Messmer, Vinko Sabolčec, Martin Jaggi2026-02-20
💬 NLP

A Scalable Framework for Evaluating Health Language Models

تقدم هذه الورقة "المعايير البولينية الدقيقة التكيفية" (Adaptive Precise Boolean rubrics)، وهي إطار تقييم قابل للتوسع يستخدم أسئلة نعم/لا مستهدفة لتقييم النماذج اللغوية الكبيرة الموجهة نحو الصحة بكفاءة وموثوقية أكبر من مقاييس ليكرت التقليدية، مما يقلل من وقت وتكاليف التقييم مع تحسين الاتفاق بين المقيمين الخبراء وغير الخبراء على حد سواء.

Neil Mallinar, A. Ali Heydari, Xin Liu, Anthony Z. Faranesh, Brent Winslow, Nova Hammerquist, Benjamin Graef, Cathy Spee (…)2026-02-20
💬 NLP

FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information

تقدم هذه الورقة FinTagging، وهو أول معيار مرجعي شامل يفكك المهمة المعقدة لوسم XBRL إلى تحديد الأرقام المالية وربط المفاهيم المالية، ليكشف أن النماذج اللغوية الكبيرة، رغم تفوقها في استخراج الكيانات المالية، تعاني بشكل كبير في ربطها بتصنيف US GAAP الكامل تحت ظروف واقعية تراعي الهيكلية.

Yan Wang, Lingfei Qian, Xueqing Peng, Yang Ren, Keyi Wang, Yi Han, Dongji Feng, Fengran Mo, Shengyuan Lin, Qinchuan Zhan (…)2026-02-20
💬 NLP

Automated Web Application Testing: End-to-End Test Case Generation with Large Language Models and Screen Transition Graphs

تقدم هذه الورقة نظاماً مؤتمتاً يستفيد من النماذج اللغوية الكبيرة بالاقتران مع مخططات انتقال الشاشة والحالة لتوليد حالات اختبار قوية وشاملة (end-to-end) للتنقل في تطبيقات الويب وتعبئة النماذج، مما يعزز تغطية الاختبار وموثوقيتهته.

Nguyen-Khang Le, Quan Minh Bui, Minh Ngoc Nguyen, Hiep Nguyen, Trung Vo, Son T. Luu, Shoshin Nomura, Minh Le Nguyen2026-02-20
💬 NLP

Persona-driven Simulation of Voting Behavior in the European Parliament with Large Language Models

تُثبت هذه الورقة أن استخدام "تلقين الشخصية" (persona prompting) بنمط "الصفر محاولة" (zero-shot) مع النماذج اللغوية الكبيرة يمكنه محاكاة السلوك التصويتي لأعضاء البرلمان الأوروبي بشكل معقول والتنبؤ بدقة بمواقف المجموعات السياسية، محققاً درجة F1 موزونة تبلغ حوالي 0.793.

Maximilian Kreutner, Marlene Lutz, Markus Strohmaier2026-02-20
💬 NLP

SPECS\texttt{SPECS}: Faster Test-Time Scaling through Speculative Drafts

تقدم الورقة البحثية SPECS\texttt{SPECS}، وهي طريقة لتوسيع نطاق وقت الاختبار تراعي زمن الاستجابة، تستفيد من نموذج أصغر لعملية المسودة التخمينية والتحقق الموجه بالمكافأة لتحقيق دقة بمستوى البحث الشعاعي (beam search) مع تقليل زمن الاستجابة بنسبة تصل إلى 19.1%.

Mert Cemri, Nived Rajaraman, Rishabh Tiwari, Xiaoxuan Liu, Kurt Keutzer, Ion Stoica, Kannan Ramchandran, Ahmad Beirami (…)2026-02-20