💬 NLP

Structure-Augmented Reasoning Generation

تقدم هذه الورقة البحثية "توليد الاستدلال المعزز بالبنية" (SARG)، وهو إطار عمل معياري لما بعد الاسترجاع يعزز قدرات نماذج اللغات الكبيرة في الاستدلال متعدد الخطوات من خلال تحويل المستندات المسترجعة غير المهيكلة إلى رسوم بيانية للمعرفة وسلاسل استدلال صريحة، مما يؤدي إلى تحسين الدقة الواقعية، وتماسك الاستدلال، والقابلية للتفسير بشكل كبير دون الحاجة إلى أدوات استرجاع مخصصة أو ضبط دقيق.

Jash Rajesh Parekh, Pengcheng Jiang, Jiawei Han2026-02-23
💬 NLP

Revela: Dense Retriever Learning via Language Modeling

تُعد ريفيلا (Revela) إطار عمل تدريب ذاتي الإشراف وقابل للتوسع، يعمل على تكييف أهداف نمذجة اللغة لتعلم المسترجعات الكثيفة عبر نمذجة التبعيات الدلالية بين المستندات من خلال الانتباه داخل الدفعة (in-batch attention)، مما يحقق أداءً هو الأفضل في فئته على الاختبارات المعيارية المتخصصة والمكثفة في الاستدلال دون الحاجة إلى أزواج استعلام-مستند مُصنفة.

Fengyu Cai, Tong Chen, Xinran Zhao, Sihao Chen, Hongming Zhang, Sherry Tongshuang Wu, Iryna Gurevych, Heinz Koeppl2026-02-23
💬 NLP

Unveiling Decision-Making in LLMs for Text Classification : Extraction of influential and interpretable concepts with Sparse Autoencoders

تقدم هذه الورقة ClassifSAE، وهي بنية مبتكرة تعتمد على المشفر التلقائي المتناثر (Sparse Autoencoder) ومصممة خصيصاً لتصنيف النصوص، حيث تتفوق على أساليب التفسير الحالية من خلال تحسين السببية وقابلية التفسير للميزات المستخرجة عبر رأس تصنيف متخصص وفقدان تشتت معدل التنشيط.

Mathis Le Bail, Jérémie Dentan, Davide Buscaldi, Sonia Vanier2026-02-23
💬 NLP

Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing

تجادل هذه الورقة بأنه للتغلب على الثقة المفرطة للنماذج اللغوية الكبيرة وتعزيز الثقة بين الإنسان والآلة، يجب أن يتبنى التعبير اللفظي عن عدم اليقين نهجاً "محاكياً للبشر" يحاكي السلوكيات اللغوية الدقيقة ويراعي التحيزات المتأصلة في التواصل البشري بشأن عدم اليقين.

Dennis Ulmer, Alexandra Lorson, Ivan Titov, Christian Hardmeier2026-02-23
💬 NLP

CoAct-1: Computer-using Multi-Agent System with Coding Actions

يُعد CoAct-1 نظاماً جديداً متعدد الوكلاء يعزز أتمتة الحاسوب من خلال الجمع التآزري بين التحكم القائم على واجهة المستخدم الرسومية والتنفيذ البرمجي المباشر، محققاً معدل نجاح جديداً هو الأفضل في فئته بنسبة 60.76% وتحسناً ملحوظاً في الكفاءة على معيار OSWorld.

Linxin Song, Yutong Dai, Viraj Prabhu, Jieyu Zhang, Taiwei Shi, Li Li, Junnan Li, Silvio Savarese, Zeyuan Chen, Jieyu Zh (…)2026-02-23
💬 NLP

Designing and Evaluating Chain-of-Hints for Scientific Question Answering

تقيم هذه الورقة ١٨ نموذجاً من نماذج اللغات الكبيرة مفتوحة المصدر في قدرتها على توليد سلاسل تلميحات ثابتة مقابل ديناميكية للإجابة على الأسئلة العلمية، كاشفةً من خلال دراسة مستخدمين أنه بينما تقيم المقاييس التلقائية جودة التلميحات، إلا أنها تفشل في استيعاب تفضيلات المتعلمين المتميزة والفعالية الدقيقة لاستراتيجيات التدعيم المختلفة بشكل كامل.

Anubhav Jangra, Smaranda Muresan2026-02-23
💬 NLP

Through the Judge's Eyes: Inferred Thinking Traces Improve Reliability of LLM Raters

تقدم هذه الورقة إطار عمل للتعاون بين البشر والنماذج اللغوية الكبيرة يستخدم أخذ العينات بالرفض لاستنتاج مسارات التفكير من التعليقات التوضيحية التي تقتصر على الملصقات فقط، والتي تُستخدم بعد ذلك لضبط النماذج اللغوية الكبيرة المفتوحة وتقييمها وتحسين الإرشادات الخاصة بالنماذج المملوكة، مما يحسن بشكل كبير من موثوقيتها وتوافقها مع الأحكام البشرية.

Xingjian Zhang, Tianhong Gao, Suliang Jin, Tianhao Wang, Teng Ye, Eytan Adar, Qiaozhu Mei2026-02-23
💬 NLP

MUCH: A Multilingual Claim Hallucination Benchmark

تقدم الورقة البحثية MUCH، وهو أول معيار متعدد اللغات للتقدير الكمي لعدم اليقين على مستوى الادعاء، والذي يتميز بخوارزمية تقسيم حتمية عالية الكفاءة ويصدر احتمالات التوليد (generation logits) لتمكين تقييم عادل وقابل للتكرار وواقعي لموثوقية النماذج اللغوية الكبيرة عبر أربع لغات أوروبية.

Jérémie Dentan, Alexi Canesse, Davide Buscaldi, Aymen Shabou, Sonia Vanier2026-02-23
💬 NLP

Cross-Lingual Interleaving for Speech Language Models

تقدم هذه الورقة طريقة تداخل عابرة للغات بسيطة وقابلة للتوسع تعمل على تحسين أداء نماذج لغة الكلام عبر اللغات دون إشراف نصي، مدعومة بإصدار مجموعة بيانات تدريب ضخمة للإنجليزية والفرنسية ومعايير مرجعية اصطناعية جديدة للتقييم.

Adel Moumen, Guangzhi Sun, Philip C. Woodland2026-02-23
💬 NLP

The Invisible Hand of AI Libraries Shaping Open Source Projects and Communities

تقترح هذه الورقة دراسة تجريبية واسعة النطاق لتحليل كيفية تأثير اعتماد مكتبات الذكاء الاصطناعي في مشاريع لغة بايثون وجافا مفتوحة المصدر على نشاط التطوير، والمشاركة المجتمعية، وتعقيد الكود من خلال مقارنة 157,700 مستودع برمجِيّ.

Matteo Esposito, Andrea Janes, Valentina Lenarduzzi, Davide Taibi2026-02-23