💬 NLP

EQ-Negotiator: Dynamic Emotional Personas Empower Small Language Models for Edge-Deployable Credit Negotiation

تقدم الورقة البحثية إطار عمل EQ-Negotiator، الذي يُمكّن النماذج اللغوية الصغيرة من التفوق بشكل ملحوظ على النماذج اللغوية الكبيرة في مفاوضات الائتمان الحساسة للخصوصية عبر دمج نظرية الألعاب ونماذج ماركوف المخفية لتتبع الحالات العاطفية ديناميكيًا، مما يثبت أن الذكاء العاطفي الاستراتيجي أكثر أهمية من حجم النموذج في التفاوض الآلي الفعال.

Yunbo Long, Yuhan Liu, Alexandra Brintrup2026-03-27
💬 NLP

TimeLens: Rethinking Video Temporal Grounding with Multimodal LLMs

تقدم هذه الورقة TimeLens، وهو إطار عمل منهجي لتوطين الزمن في الفيديو، والذي يؤسس لمعيار عالي الجودة ومجموعة بيانات تدريبية (TimeLens-Bench وTimeLens-100K) مع اقتراح تصميمات خوارزمية فعالة مثل الترميز النصي المتداخل والتعلم المعزز من خلال التغذية الراجعة لتقليل استهلاك الموارد (RLVR) الخالي من التفكير لتحقيق أداء رائد بين النماذج اللغوية الكبيرة متعددة الوسائط مفتوحة المصدر.

Jun Zhang, Teng Wang, Yuying Ge, Yixiao Ge, Xinhao Li, Ying Shan, Limin Wang2026-03-27
💬 NLP

A Geolocation-Aware Multimodal Approach for Ecological Prediction

تقدم هذه الورقة البحثية GAMMA، وهو إطار عمل متعدد الوسائط يعتمد على تقنية "ترانسفورمر" (transformer) ومدرك للموقع الجغرافي، يعمل على دمج مصادر البيانات البيئية غير المتجانسة بفعالية، مثل صور الاستشعار عن بعد المستمرة والملاحظات النوعية المتباعدة للأنواع، لتحسين دقة التنبؤ بالمتغيرات البيئية واسعة النطاق بشكل كبير.

Valerie Zermatten, Chiara Vanalli, Gencer Sumbul, Diego Marcos, Devis Tuia2026-03-27
💬 NLP

SciCoQA: Quality Assurance for Scientific Paper--Code Alignment

تقدم الورقة البحثية SciCoQA، وهي مجموعة بيانات تضم 635 تباينًا بين الورقة العلمية والكود البرمجي مستمدة من مشكلات واقعية وتوليد اصطناعي لتقييم وتسليط الضوء على أوجه القصور في النماذج اللغوية الكبيرة في ضمان التنفيذ الأمين للمنشورات العلمية.

Tim Baumgärtner, Iryna Gurevych2026-03-27
💬 NLP

Towards Simulating Social Media Users with LLMs: Evaluating the Operational Validity of Conditioned Comment Prediction

تقدم هذه الدراسة "التنبؤ بالتعليقات المشروطة" (CCP) لتقييم النماذج اللغوية الكبيرة كأهداف في العلوم الاجتماعية، كاشفةً أنه بينما يعمل الضبط الدقيق الخاضع للإشراف على مواءمة بنية المخرجات، فإنه يؤدي إلى تدهور التجذر الدلالي ويجعل التكييف البيوغرافي الصريح فائضاً عن الحاجة لصالح الاستدلال السلوكي الكامن من أجل محاكاة المستخدم عالية الدقة.

Nils Schwager, Simon Münker, Alistair Plum, Achim Rettinger2026-03-27
💬 NLP

When Consistency Becomes Bias: Interviewer Effects in Semi-Structured Clinical Interviews

تكشف هذه الورقة أن نماذج الكشف التلقائي عن الاكتئاب المدربة على مقابلات سريرية شبه منظمة غالباً ما تحقق أداءً مبالغاً فيه من خلال استغلال الانحيازات المنهجية في محفزات المحاور بدلاً من الإشارات اللغوية الحقيقية من المشاركين، مما يسلط الض الضوء على الحاجة الماسة لتقييد التحليل بكلمات المريض فقط من أجل قابلية تفسير صحيحة.

Hasindri Watawana, Sergio Burdisso, Diego A. Moreno-Galván, Fernando Sánchez-Vega, A. Pastor López-Monroy, Petr Motlicek (…)2026-03-27
💬 NLP

Demystifying When Pruning Works via Representation Hierarchies

تشرح هذه الورقة سبب نجاح تقليم الشبكات في المهام غير التوليدية وفشله في الإعدادات التوليدية، وذلك من خلال إثبات أنه بينما تظل تمثيلات التضمين واللوجيت (logit) قوية تجاه التقليم، فإن التحويل غير الخطي إلى الاحتمالات يضخم الاضطرابات، مما يتسبب في تراكم الأخطاء أثناء عملية التوليد.

Shwai He, Guoheng Sun, Haichao Zhang, Yun Fu, Ang Li2026-03-27
💬 NLP

SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks

تقدم الورقة البحثية SlopCodeBench، وهو معيار مرجعي يوضح أن وكلاء البرمجة الحاليين يفشلون بشكل منهجي في المهام التكرارية طويلة الأمد من خلال إظهار تدهور مستمر في جودة الكود عبر زيادة الإطناب والتآكل الهيكلي، وهي مشكلة تفشل معايير معدل النجاح في رصدها.

Gabriel Orlanski, Devjeet Roy, Alexander Yun, Changho Shin, Alex Gu, Albert Ge, Dyah Adila, Frederic Sala, Aws Albarghou (…)2026-03-27
💬 NLP

Synthetic Rewriting as a Quality Multiplier: Evidence from Portuguese Continued Pretraining

تُثبت هذه الورقة أن إعادة الكتابة الاصطناعية تعمل كمضاعف للجودة يعتمد على الحجم في مرحلة ما قبل التدريب المستمر للغة البرتغالية، مما يعزز الأداء بشكل كبير عند تطبيقها على بيانات مصدر عالية الجودة، لكنها تقدم مكاسب ضئيلة للبيانات منخفضة الجودة.

Thales Sales Almeida, Rodrigo Nogueira, Hélio Pedrini2026-03-27
🤖 machine learning

Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models

تقدم هذه الورقة نهجاً للتعلم التعزيزي متعدد الإجابات يدرب النماذج اللغوية على توليد فرضيات متعددة معقولة مع تقديرات الثقة في تمريرة أمامية واحدة، مما يوفر بديلاً فعالاً من حيث الحوسبة لطرق التوسع أثناء الاستنتاج مع تحسين التنوع والمعايرة والدقة عبر مختلف الاختبارات المعيارية.

Isha Puri, Mehul Damani, Idan Shenfeld, Marzyeh Ghassemi, Jacob Andreas, Yoon Kim2026-03-27