💬 NLP

UKP_Psycontrol at SemEval-2026 Task 2: Modeling Valence and Arousal Dynamics from Text

حقق نظام UKP_Psycontrol، الذي يجمع بين التلقين باستخدام النماذج اللغوية الكبيرة، ونموذج الإنتروبيا القصوى الزوجي، ونهج الانحدار العصبي مع تضمينات المستخدم، المركز الأول في مهمة SemEval-2026 Task 2 من خلال نمذجة الإشارات العاطفية الثابتة بفعالية، مع إثبات أن التغيرات العاطفية قصيرة المدى يتم التنبؤ بها بشكل أفضل من خلال مسارات الحالة الرقمية الأخيرة بدلاً من الدلالات النصية.

Darya Hryhoryeva, Amaia Zurinaga, Hamidreza Jamalabadi, Iryna Gurevych2026-04-24
💬 NLP

Finding Meaning in Embeddings: Concept Separation Curves

تقدم هذه الورقة "منحنيات فصل المفاهيم" (Concept Separation Curves)، وهي طريقة تقييم جديدة مستقلة عن المصنفات، تعمل على تقييم الاستقرار المفاهيمي لتمثيلات الجمل عبر التحديد الكمي المنهجي لاستجاباتها للضجيج النحوي والنفي الدلالي عبر لغات ومجالات متعددة.

Paul Keuren, Marc Ponsen, Robert Ayoub Bagheri2026-04-24
💬 NLP

Measuring Opinion Bias and Sycophancy via LLM-based Coercion

تقدم هذه الورقة البحثية **llm-bias-bench**، وهو إطار عمل مفتوح المصدر يستخدم استراتيجيات استقصاء مباشرة وغير مباشرة عبر شخصيات مستخدمين متنوعة لقياس والتمييز بين انحياز الرأي الحقيقي للنماذج اللغوية الكبيرة وميلها نحو التملق، كاشفةً أن المناظرة الجدلية تثير معدلات أعلى بكثير من محاكاة الآراء مقارنة بالاستجواب المباشر.

Rodrigo Nogueira, Giovana Kerche Bonás, Thales Sales Almeida, Andrea Roque, Ramon Pires, Hugo Abonizio, Thiago Laitz, Ce (…)2026-04-24
💬 NLP

Process Supervision via Verbal Critique Improves Reasoning in Large Language Models

تقدم هذه الورقة الإشراف العملي اللفظي (VPS)، وهو إطار عمل لا يتطلب تدريباً يستفيد من الانتقادات المهيكلة باللغة الطبيعية من مشرف أقوى لتوجيه حلقة تكرارية من التوليد والنقد والتحسين، مما يحسن أداء الاستنتاج بشكل كبير عبر معايير متنوعة من خلال ترسيخ دقة النقد كمحور جديد للتوسع أثناء وقت الاستنتاج.

Hao-Yuan Chen2026-04-24
💬 NLP

Multilinguality at the Edge: Developing Language Models for the Global South

تتناول هذه الورقة تحدي "الميل الأخير" المتمثل في نشر النماذج اللغوية في دول الجنوب العالمي من خلال استعراض 232 دراسة حول تقاطع معالجة اللغات الطبيعية متعددة اللغات والحوسبة الطرفية، مقدمةً توصيات عملية للتغلب على القيود التقنية وتعزيز التقنيات اللغوية العادلة.

Lester James V. Miranda, Songbo Hu, Roi Reichart, Anna Korhonen2026-04-24
💬 NLP

Fine-Grained Perspectives: Modeling Explanations with Annotator-Specific Rationales

تقترح هذه الورقة إطار عمل يعمل على نمذجة تنبؤات التسميات والتعليلات الخاصة بكل مُعلِّم بشكل مشترك من خلال الاستفادة من آلية "جواز سفر المستخدم" وهيكليّتي شرح متميزتين، مما يثبت أن دمج المبررات دقيقة التفاصيل يحسن الأداء التنبؤي بشكل كبير ويوفر تمثيلاً أغنى للاختلاف القائم على المنظور.

Olufunke O. Sarumi, Charles Welch, Daniel Braun2026-04-24
💬 NLP

Phonological Subspace Collapse Is Aetiology-Specific and Cross-Lingually Stable: Evidence from 3,374 Speakers

تُظهر هذه الدراسة أن طريقة تحليل الفضاء الفرعي الفونولوجي التي لا تتطلب تدريباً، والتي تم التحقق من صحتها على 3,374 متحدثاً عبر 12 لغة و5 مسببات مرضية، تحدد بمتانة ملفات تعريف تدهور متميزة، ومستقرة عبر اللغات، ومستقلة عن البنية الهندسية، لتوصيف شدة عسر التلفظ على مستوى المجموعة، رغم القيود في التصنيف على المستوى الفردي.

Bernard Muller, Antonio Armando Ortiz Barrañón, LaVonne Roberts2026-04-24
💬 NLP

Beyond N-gram: Data-Aware X-GRAM Extraction for Efficient Embedding Parameter Scaling

تقترح الورقة البحثية إطار عمل X-GRAM، وهو إطار عمل ديناميكي لحقن الرموز (tokens) يعتمد على التردد، يستخدم التجزئة الهجينة، وخلط الأسماء المستعارة، والبوابات المدركة للعمق لضغط التضمينات ذات الذيل الطويل واستخراج الميزات المحلية، مما يؤدي إلى فك الارتباط بين قدرة النموذج وعمليات النقطة العائمة (FLOPs) وتحسين الدقة وكفاءة المعلمات بشكل كبير في البنيات المعززة بالذاكرة.

Yilong Chen, Yanxi Xie, Zitian Gao, He Xin, Yihao Xiao, Renbiao Liu, Haoming Luo, Yifan Luo, Zhengmao Ye, Tingwen Liu, X (…)2026-04-24
💬 NLP

AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA

تقدم الورقة البحثية AUDITA، وهو معيار مرجعي واسع النطاق للإجابة على الأسئلة الصوتية مُنسق بشرياً، صُمم لاختبار الاستدلال السمعي العميق بصرامة بما يتجاوز الإشارات السطحية، كاشفاً أن النماذج الحالية الرائدة تتراجع بشكل كبير مقارنة بالبشر في المهام التي تتطلب تبعات زمنية طويلة المدى واستنتاجاً معقداً.

Tasnim Kabir, Dmytro Kurdydyk, Aadi Palnitkar, Liam Dorn, Ahmed Haj Ahmed, Jordan Lee Boyd-Graber2026-04-24
💬 NLP

Misinformation Span Detection in Videos via Audio Transcripts

تتناول هذه الورقة تحدي تحديد معلومات مضللة محددة داخل مقاطع الفيديو من خلال تقديم مجموعتين جديدتين من النصوص الصوتية المشروحة، وإثبات أن النماذج اللغوية الحديثة يمكنها اكتشاف هذه المقاطع المضللة بفعالية بدرجة F1 تبلغ 0.68.

Breno Matos, Rennan C. Lima, Savvas Zannettou, Fabricio Benevenuto, Rodrygo L. T. Santos2026-04-24