💬 NLP

Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing

تجادل هذه الورقة بأنه للتغلب على الثقة المفرطة للنماذج اللغوية الكبيرة وتعزيز الثقة بين الإنسان والآلة، يجب أن يتبنى التعبير اللفظي عن عدم اليقين نهجاً "محاكياً للبشر" يحاكي السلوكيات اللغوية الدقيقة ويراعي التحيزات المتأصلة في التواصل البشري بشأن عدم اليقين.

Dennis Ulmer, Alexandra Lorson, Ivan Titov, Christian Hardmeier2026-02-23
💬 NLP

CoAct-1: Computer-using Multi-Agent System with Coding Actions

يُعد CoAct-1 نظاماً جديداً متعدد الوكلاء يعزز أتمتة الحاسوب من خلال الجمع التآزري بين التحكم القائم على واجهة المستخدم الرسومية والتنفيذ البرمجي المباشر، محققاً معدل نجاح جديداً هو الأفضل في فئته بنسبة 60.76% وتحسناً ملحوظاً في الكفاءة على معيار OSWorld.

Linxin Song, Yutong Dai, Viraj Prabhu, Jieyu Zhang, Taiwei Shi, Li Li, Junnan Li, Silvio Savarese, Zeyuan Chen, Jieyu Zh (…)2026-02-23
💬 NLP

Designing and Evaluating Chain-of-Hints for Scientific Question Answering

تقيم هذه الورقة ١٨ نموذجاً من نماذج اللغات الكبيرة مفتوحة المصدر في قدرتها على توليد سلاسل تلميحات ثابتة مقابل ديناميكية للإجابة على الأسئلة العلمية، كاشفةً من خلال دراسة مستخدمين أنه بينما تقيم المقاييس التلقائية جودة التلميحات، إلا أنها تفشل في استيعاب تفضيلات المتعلمين المتميزة والفعالية الدقيقة لاستراتيجيات التدعيم المختلفة بشكل كامل.

Anubhav Jangra, Smaranda Muresan2026-02-23
💬 NLP

Through the Judge's Eyes: Inferred Thinking Traces Improve Reliability of LLM Raters

تقدم هذه الورقة إطار عمل للتعاون بين البشر والنماذج اللغوية الكبيرة يستخدم أخذ العينات بالرفض لاستنتاج مسارات التفكير من التعليقات التوضيحية التي تقتصر على الملصقات فقط، والتي تُستخدم بعد ذلك لضبط النماذج اللغوية الكبيرة المفتوحة وتقييمها وتحسين الإرشادات الخاصة بالنماذج المملوكة، مما يحسن بشكل كبير من موثوقيتها وتوافقها مع الأحكام البشرية.

Xingjian Zhang, Tianhong Gao, Suliang Jin, Tianhao Wang, Teng Ye, Eytan Adar, Qiaozhu Mei2026-02-23
💬 NLP

MUCH: A Multilingual Claim Hallucination Benchmark

تقدم الورقة البحثية MUCH، وهو أول معيار متعدد اللغات للتقدير الكمي لعدم اليقين على مستوى الادعاء، والذي يتميز بخوارزمية تقسيم حتمية عالية الكفاءة ويصدر احتمالات التوليد (generation logits) لتمكين تقييم عادل وقابل للتكرار وواقعي لموثوقية النماذج اللغوية الكبيرة عبر أربع لغات أوروبية.

Jérémie Dentan, Alexi Canesse, Davide Buscaldi, Aymen Shabou, Sonia Vanier2026-02-23
💬 NLP

Cross-Lingual Interleaving for Speech Language Models

تقدم هذه الورقة طريقة تداخل عابرة للغات بسيطة وقابلة للتوسع تعمل على تحسين أداء نماذج لغة الكلام عبر اللغات دون إشراف نصي، مدعومة بإصدار مجموعة بيانات تدريب ضخمة للإنجليزية والفرنسية ومعايير مرجعية اصطناعية جديدة للتقييم.

Adel Moumen, Guangzhi Sun, Philip C. Woodland2026-02-23
💬 NLP

The Invisible Hand of AI Libraries Shaping Open Source Projects and Communities

تقترح هذه الورقة دراسة تجريبية واسعة النطاق لتحليل كيفية تأثير اعتماد مكتبات الذكاء الاصطناعي في مشاريع لغة بايثون وجافا مفتوحة المصدر على نشاط التطوير، والمشاركة المجتمعية، وتعقيد الكود من خلال مقارنة 157,700 مستودع برمجِيّ.

Matteo Esposito, Andrea Janes, Valentina Lenarduzzi, Davide Taibi2026-02-23
💬 NLP

Jailbreaking Leaves a Trace: Understanding and Detecting Jailbreak Attacks from Internal Representations of Large Language Models

تقترح هذه الورقة إطار عمل خفيف الوزن للكشف عن كسر الحماية (jailbreak) والتخفيف من آثاره أثناء مرحلة الاستدلال، والذي يستفيد من الأنماط المتسقة في الفضاء الكامن ضمن التمثيلات الداخلية للنماذج اللغوية الكبيرة لتحديد المطالبات الضارة وتعطيلها دون الحاجة إلى ضبط دقيق للنموذج أو كواشف مساعدة.

Sri Durga Sai Sowmya Kadali, Evangelos E. Papalexakis2026-02-23
💬 NLP

AI Hallucination from Students' Perspective: A Thematic Analysis

تحلل هذه الدراسة تجارب طلاب الجامعات مع الهلوسة الاصطناعية، كاشفةً أنهم يواجهونها بشكل أساسي من خلال الاستشهادات المفبركة والثقة المضللة، ويعتمدون على استراتيجيات كشف متفاوتة تتراوح من الحدس إلى التحقق، وغالباً ما يحملون تصورات خاطئة حول أسباب هذه الأخطاء، مما يؤكد الحاجة الملحة لدمج الوعي بالهلوسة والنماذج الذهنية الدقيقة في مناهج محو الأمية بالذكاء الاصطناي.

Abdulhadi Shoufan, Ahmad-Azmi-Abdelhamid Esmaeil2026-02-23
💬 NLP

Lost Before Translation: Social Information Transmission and Survival in AI-AI Communication

تُثبت هذه الورقة أن التواصل بين الذكاء الاصطناعي والذكاء الاصطناعي يشوه المعلومات بشكل منهجي من خلال التقارب، والبقاء الانتقائي، والترشيح التنافسي، مما ينتج محتوىً يبدو أكثر مصداقية للبشر بينما يؤدي في الوقت ذاته إلى تآكل الاستدعاء الحقائقي، والتوازن، واللمسات العاطفية الدقيقة.

Bijean Ghafouri, Emilio Ferrara2026-02-23