💬 NLP

ReIn: Conversational Error Recovery with Reasoning Inception

تقترح الورقة البحثية ReIn، وهي طريقة للتدخل في وقت الاختبار تعزز مرونة الوكلاء الحواريين تجاه الأخطاء الناجمة عن المستخدم عبر استخدام وحدة خارجية لحقن استدلال التعافي في عملية اتخاذ القرار لدى الوكيل دون تعديل معلماته أو مطالباته، مما يؤدي إلى تحسين معدلات نجاح المهام بشكل كبير.

Takyoung Kim, Jinseok Nam, Chandrayee Basu, Xing Fan, Chengyuan Ma, Heng Ji, Gokhan Tur, Dilek Hakkani-Tür2026-02-20
💬 NLP

Projective Psychological Assessment of Large Multimodal Models Using Thematic Apperception Tests

تقيم هذه الدراسة الأداء الشبيه بالشخصية للنماذج اللغوية الكبيرة متعددة الوسائط باستخدام اختبارات تفهم الموضوع (TAT) وإطار عمل (SCORS-G)، كاشفةً أنه في حين تُظهر هذه النماذج فهماً قوياً للتفاعل بين الأشخاص ومفهوم الذات يضاهي الخبراء البشر، إلا أنها تعاني باستمرار من صعوبة في إدراك العدوان وتنظيمه، مع تحسن الأداء في عائلات النماذج الأكبر والأحدث.

Anton Dzega, Aviad Elyashar, Ortal Slobodin, Odeya Cohen, Rami Puzis2026-02-20
💬 NLP

Same Meaning, Different Scores: Lexical and Syntactic Sensitivity in LLM Evaluation

تُظهر هذه الدراسة أن الاضطرابات المعجمية والنحوية المنضبطة تُضعف الأداء وتزعزع استقرار التصنيفات للنماذج اللغوية الكبيرة عبر المقاييس المرجعية الرئيسية بشكل كبير، مما يكشف عن الاعتماد على الأنماط السطحية بدلاً من الكفاءة اللغوية المتينة، ويبرز الحاجة الماسة لاختبار المتانة في التقييمات القياسية.

Bogdan Kostić, Conor Fallon, Julian Risch, Alexander Löser2026-02-20
💬 NLP

WebFAQ 2.0: A Multilingual QA Dataset with Mined Hard Negatives for Dense Retrieval

تقدم هذه الورقة WebFAQ 2.0، وهي مجموعة بيانات متعددة اللغات موسعة بشكل كبير تضم 198 مليون زوج من الأسئلة والأجوبة الشائعة عبر 108 لغات، وتتميز باستخراج النفي الصعب وتدعم استراتيجيات تدريب الاسترجاع الكثيف المتقدمة لدفع أبحاث استرجاع المعلومات متعددة اللغات وعبر اللغات.

Michael Dinzinger, Laura Caspari, Ali Salman, Irvin Topi, Jelena Mitrović, Michael Granitzer2026-02-20
💬 NLP

RPDR: A Round-trip Prediction-Based Data Augmentation Framework for Long-Tail Question Answering

تقدم هذه الورقة البحثية RPDR، وهو إطار عمل جديد لتعزيز البيانات يستفيد من توليد البيانات الاصطناعية والتنبؤ عبر الرحلة الكاملة لاختيار عينات تدريب عالية الجودة وسهلة التعلم، مما يعزز بشكل كبير أداء المسترجعات الكثيفة في معايير الإجابة على الأسئلة ذات الذيل الطويل.

Yiming Zhang, Siyue Zhang, Junbo Zhao, Chen Zhao2026-02-20
💬 NLP

ABCD: All Biases Come Disguised

تقدم هذه الورقة بروتوكول تقييم مخفض للتحيز لمعايير أسئلة الاختيار من متعدد، يستبدل تسميات الخيارات القياسية بتسميات موحدة وغير مرتبة ويستخدم تشابه الجمل لمطابقة الإجابات، مما يحسن بشكل كبير من متانة التقييم ضد تبديلات الإجابات مع الحفاظ على أداء النموذج.

Mateusz Nowak, Xavier Cadet, Peter Chin2026-02-20
💬 NLP

PEACE 2.0: Grounded Explanations and Counter-Speech for Combating Hate Expressions

تُعد PEACE 2.0 أداة مبتكرة تعزز تحليل خطاب الكراهية والحد منه عبر استخدام مسار توليد مدعوم بالاسترجاع (Retrieval-Augmented Generation) لتقديم تفسيرات قائمة على الأدلة وتوليد ردود واقعية تلقائياً لكل من الرسائل التي تحتوي على كراهية صريحة وضمنية.

Greta Damo, Stéphane Petiot, Elena Cabrio, Serena Villata2026-02-20
💬 NLP

Small LLMs for Medical NLP: a Systematic Analysis of Few-Shot, Constraint Decoding, Fine-Tuning and Continual Pre-Training in Italian

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة الصغيرة (حوالي مليار معلمة) يمكنها أداء مهام متنوعة في معالجة اللغات الطبيعية الطبية الإيطالية بفعالية، وغالبًا ما تتفوق على النماذج الأكبر عند ضبطها دقيقًا أو دمجها مع التلقين بلقطات قليلة وفك التشفير المقيد، مع إصدار مجموعات بيانات ونماذج مدربة شاملة باللغة الإيطالية للمجال الطبي.

Pietro Ferrazzi, Mattia Franzin, Alberto Lavelli, Bernardo Magnini2026-02-20
💬 NLP

The Anxiety of Influence: Bloom Filters in Transformer Attention Heads

تحدد هذه الورقة وتُوصّف رؤوس انتباه محددة في نماذج المحولات تعمل كمرشحات بلوم (Bloom filters) عالية الدقة وحساسة للمسافة للكشف عن تكرار الرموز، مما يكشف عن نظام متعدد الدقة يتركز في الطبقات المبكرة ويتعمم عبر أنواع الرموز ويتواجد جنباً إلى جنب مع أدوار حوسبية أوسع.

Peter Balogh2026-02-20