💬 NLP

Depression Risk Assessment in Social Media via Large Language Models

تقترح هذه الورقة نظاماً فعالاً من حيث التكلفة وقابلاً للتوسع باستخدام النماذج اللغوية الكبيرة لتقييم مخاطر الاكتئاب في منشورات "ريديت" عبر تصنيف المشاعر متعدد الملصقات ومؤشر شدة موزون، مما يظهر أداءً تنافسياً ضد النماذح المضبوطة بدقة ويكشف عن ملفات تعريف مخاطر مستقرة عبر المجتمعات المختلفة عبر الإنترنت.

Giorgia Gulino, Manuel Petrucci2026-04-23
💬 NLP

Structured Disagreement in Health-Literacy Annotation: Epistemic Stability, Conceptual Difficulty, and Agreement-Stratified Inference

تجادل هذه الورقة بأن الاختلاف في عملية ترميز الثقافة الصحية المتدرجة ناتج بنيوياً عن تعقيد المهمة بدلاً من كونه خطأً من المرمّنين، وأن الحفاظ على هذا التباين المنظوري ضروري إحصائياً لتجنب طمس أو عكس النتائج الرئيسية في العلوم الاجتماعية.

Olga Kellert, Sriya Kondury, Candice Koo, Nemika Tyagi, Steffen Eikenberry2026-04-23
🤖 machine learning

Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة ترمز لعدم اليقين والصحة كظواهر داخلية متميزة من خلال استخدام المشفّرات التلقائية المتفرقة لتحديد ثلاث مجموعات وظيفية مختلفة من الميزات — عدم اليقين الصرف، وعدم الصحة الصرف، والميزات المختلطة — حيث يؤدي كبح الأخيرة إلى تحسين الدقة بشكل كبير ويُمكّن من الامتناع الانتقائي الفعال.

Het Patel, Tiejin Chen, Hua Wei, Evangelos E. Papalexakis, Jia Chen2026-04-23
💬 NLP

Bias in the Tails: How Name-conditioned Evaluative Framing in Resume Summaries Destabilizes LLM-based Hiring

تكشف هذه الورقة أنه بينما تحافظ ملخصات السير الذاتية التي تولدها النماذج اللغوية الكبيرة على الاستقرار الواقعي، فإنها تظهر تحيزات دقيقة مشروطة بالأسماء في اللغة التقييمية — لا سيما في النماذج مفتوحة المصدر وفي الأطراف التوزيعية — مما يمكن أن يحول التمييز الاتجاهي إلى عدم استقرار متماثل يتملص من عمليات تدقيق العدالة التقليدية في أنظمة التوظيف المؤتمتة.

Huy Nghiem, Phuong-Anh Nguyen-Le, Sy-Tuyen Ho, Hal Daume III2026-04-23
💬 NLP

From Recall to Forgetting: Benchmarking Long-Term Memory for Personalized Agents

تقدم هذه الورقة البحثية Memora، وهو معيار قياس للذاكرة طويلة المدى يمتد من أسابيع إلى أشهر يقيم الوكلاء المخصصين في مهام التذكر والاستنتاج والتوصية باستخدام مقياس جديد لـ "دقة الذاكرة الواعية بالنسيان" (FAMA)، مما يكشف أن النماذج الحالية تعتمد بشكل متكرر على معلومات عفا عليها الزمن وتواجه صعوبة في التوفيق بين الذكريات المتطورة رغم التحسينات الطفيفة الناتجة عن وكلاء الذاكرة المخصصين.

Md Nayem Uddin, Kumar Shubham, Eduardo Blanco, Chitta Baral, Gengyu Wang2026-04-23
💬 NLP

Frictionless Love: Associations Between AI Companion Roles and Behavioral Addiction

تحلل هذه الدراسة ما يقرب من 250,000 منشور على موقع ريديت لتكشف أن الأدوار المجازية المحددة التي تتبناها رفقاء الذكاء الاصطناعي (مثل "توأم الروح" أو "المدرب") تشكل بشكل متميز تفاعلات المستخدمين والفوائد أو الأضرار المتصورة، حيث ترتبط بعض الأدوار مثل "المدرب" بشكل مفاجئ بقوة أكبر مع علامات الإدمان السلوكي مقارم بغيرها.

Vibhor Agarwal, Ke Zhou, Edyta Paulina Bogucka, Daniele Quercia2026-04-23
💬 NLP

EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training

تقترح الورقة البحثية EmbodiedMidtrain، وهي طريقة تسد الفجوة بين نماذج الرؤية واللغة (VLMs) ونماذج الرؤية واللغة والعمل (VLAs) باستخدام محرك بيانات لتنسيق بيانات نماذج VLMs المتوافقة مع نماذج VLAs من أجل التدريب المتوسط، مما يحسن بشكل كبير أداء التلاعب الروبوتي في المهام النهائية عبر مختلف الهياكل الأساسية.

Yiyang Du, Zhanqiu Guo, Xin Ye, Liu Ren, Chenyan Xiong2026-04-23
💬 NLP

TriEx: A Game-based Tri-View Framework for Explaining Internal Reasoning in Multi-Agent LLMs

تقدم هذه الورقة TriEx، وهو إطار عمل ثلاثي الرؤية قائم على الألعاب يعزز قابلية التفسير للنماذج اللغوية الكبيرة متعددة الوكلاء من خلال مواءمة الاستدلال من منظور الشخص الأول، وحالات الاعتقاد من منظور الشخص الثاني، وتدقيقات "الأوراكل" من منظور الشخص الثالث للكشف عن عدم التطابق المنهجي بين المنطق المعلن للوكلاء، ومعتقداتهم الداخلية، وأفعالهم الفعلية.

Ziyi Wang, Chen Zhang, Wenjun Peng, Qi Wu, Xinyu Wang2026-04-23
💬 NLP

Large language models perceive cities through a culturally uneven baseline

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة لا تدرك المدن من منظور ثقافي محايد، بل من خلال أساس ثقافي غير متكافئ ينحاز بشكل منهجي للرؤى الغربية ويؤثر على التقييمات العاطفية، حتى عند توجيهها بآراء ثقافية غير غربية.

Rong Zhao, Wanqi Liu, Zhizhou Sha, Nanxi Su, Yecheng Zhang2026-04-23
🤖 machine learning

On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks

تُظهر هذه الورقة أن النماذج اللغوية القائمة على الانتشار تُبدي متانة فائقة في التكميم مقارنة بنظيراتها ذات التوليد الذاتي، مما يشير إلى أنها تقدم مزايا كبيرة للنشر الفعال في مهام البرمجة.

Aarav Gupta, Gururaj Deshpande, Chandreyi Chakraborty2026-04-23