💬 NLP

Cross-Entropy Is Load-Bearing: A Pre-Registered Scope Test of the K-Way Energy Probe on Bidirectional Predictive Coding

تُظهر هذه الدراسة المسجلة مسبقاً أن أداء مسبار الطاقة متعدد المسارات (K-way energy probe) بالنسبة لـ "softmax" يعتمد بشكل كبير على تدريب الإنتروبيا المتقاطعة (cross-entropy training)، الذي يستحث معايير لوجيت (logit norms) أكبر بكثير وميزة ترتيب ثابتة المقياس، بدلاً من اعتماده على ديناميكيات الاستدلال ثنائي الاتجاه أو مقدار الحركة الكامنة.

Jon-Paul Cacioli2026-04-24
💬 NLP

Explainable Disentangled Representation Learning for Generalizable Authorship Attribution in the Era of Generative AI

تقدم هذه الورقة البحثية نموذج "المُشفّر التلقائي التبايني لتأليف النصوص القابل للتفسير" (EAVAE)، وهو إطار عمل مبتكر يحقق عزواً قوياً وعاماً للمؤلف وكشفاً للنصوص المولدة بواسطة الذكاء الاصطناعي من خلال الفصل الصريح بين الأسلوب والمحتوى عبر الفصل المعماري ومميز فريد يقوم في آن واحد بالتحقق من أزواج التمثيلات وتوليد تفسيرات باللغة الطبيعية.

Hieu Man, Van-Cuong Pham, Nghia Trung Ngo, Franck Dernoncourt, Thien Huu Nguyen2026-04-24
💬 NLP

CI-Work: Benchmarking Contextual Integrity in Enterprise LLM Agents

تقدم الورقة البحثية CI-Work، وهو معيار يكشف أن وكلاء نماذج اللغات الكبيرة (LLM) للمؤسسات الرائدة ينتهكون سلامة السياق بشكل متكرر عبر تسريب المعلومات الحساسة، وهي مشكلة تزداد سوءًا مع ارتفاع فائدة المهام ولا يمكن حلها بمجرد زيادة حجم النموذج، مما يستلزم تحولًا نحو بنيات تركز على السياق.

Wenjie Fu, Xiaoting Qin, Jue Zhang, Qingwei Lin, Lukas Wutschitz, Robert Sim, Saravan Rajmohan, Dongmei Zhang2026-04-24
💬 NLP

When Bigger Isn't Better: A Comprehensive Fairness Evaluation of Political Bias in Multi-News Summarisation

تقيم هذه الدراسة التحيز السياسي في تلخيص الأخبار متعددة الوثائق عبر 13 نموذجاً لغوياً كبيراً باستخدام مجموعة بيانات FairNews، مما يكشف أن النماذج متوسطة الحجم غالباً ما تتفوق على النماذج الأكبر في العدالة، وأن إزالة التحيز القائم على التلقين يعتمد بشكل كبير على النموذج، وأن مشاعر الكيانات تظل بعداً مقاوماً بشكل خاص للتدخل.

Nannan Huang, Iffat Maab, Junichi Yamagishi2026-04-24
📈 economics

Ideological Bias in LLMs' Economic Causal Reasoning

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تظهر تحيزاً أيديولوجياً منهجياً في الاستدلال الاقتصادي السببي، حيث تُظهر دقة أعلى بكثير وانحرافاً اتجاهياً نحو وجهات النظر الموجهة نحو التدخل (المؤيدة للحكومة) مقارنة بوجات النظر الموجهة نحو السوق عند تقييم التدخلات الاقتصادية المثيرة للجدل.

Donggyu Lee, Hyeok Yun, Jungwon Kim, Junsik Min, Sungwon Park, Sangyoon Park, Jihee Kim2026-04-24
💬 NLP

Beyond Single Plots: A Benchmark for Question Answering on Multi-Charts

تقدم هذه الورقة PolyChartQA، وهي مجموعة بيانات متوسطة الحجم من صور الرسوم البيانية المتعددة وأزواج الأسئلة والأجوبة المصممة لاختبار وتقييم أداء النماذج اللغوية متعددة الوسائط في استخلاص الرؤى من التصورات البيانية المعقدة والمتعددة.

Azher Ahmed Efat, Seok Hwan Song, Wallapak Tavanapong2026-04-24
💬 NLP

CARE: Counselor-Aligned Response Engine for Online Mental-Health Support

تقدم الورقة البحثية CARE، وهو محرك استجابة متوافق مع المستشارين يقوم بضبط النماذج اللغوية الكبيرة مفتوحة المصدر بناءً على محادثات أزمات تم التحقق منها من قبل خبراء باللغتين العبرية والعربية لتوليد استجابات داعمة نفسياً في الوقت الفعلي تعزز سير عمل المستشارين وجودة الرعاية في سياقات اللغات ذات الموارد المحدودة.

Hagai Astrin, Ayal Swaid, Avi Segal, Kobi Gal2026-04-24
💬 NLP

ReaGeo: Reasoning-Enhanced End-to-End Geocoding with LLMs

تقدم هذه الورقة البحثية ReaGeo، وهو إطار عمل متكامل للترميز الجغراوي (geocoding) يسخر النماذج اللغوية الكبيرة لتحويل التنبؤ بالإحداثيات إلى مهمة توليد نصوص معززة بالتفكير المتسلسل (Chain-of-Thought) والتعلم التعزيزي، مما يتغلب على قيود طرق الاسترجاع التقلية متعددة المراحل للتعامل بدقة مع مختلف استعلامات العناوين والمواقع المكانية.

Jian Cui, Zhiyuan Ren, Desheng Weng, Yongqi Zhao, Gong Wenbin, Yu Lei, Zhenning Dong2026-04-24
🤖 machine learning

mcdok at SemEval-2026 Task 13: Finetuning LLMs for Detection of Machine-Generated Code

يعمل نظام mcdok الخاص بالمهمة 13 من مسابقة SemEval-2026 على تكييف نهج mdok لكشف النصوص عبر ضبط النماذج اللغوية الكبيرة المتخصصة في الأكواد برمجياً لمعالجة كشف الأكواد المولدة آلياً، ونسبها، وتحديد الأكواد الهجينة بشكل تنافسي، رغم استمرار وجود فجوات كبيرة في الأداء مقارنة بالأنظمة المتصدرة.

Adam Skurla, Dominik Macko, Jakub Simko2026-04-24
💬 NLP

MKJ at SemEval-2026 Task 9: A Comparative Study of Generalist, Specialist, and Ensemble Strategies for Multilingual Polarization

يقدم فريق MKJ إطار عمل متكيف لغوياً لمهمة SemEval-2026 Task 9 يجمع استراتيجياً بين النماذج العامة متعددة اللغات، والنماذج المتخصصة لكل لغة، والفرق الهجينة لتحقيق متوسط F1 كلي قدره 0.796 عبر 22 لغة، مما يثبت أن تطويع اختيار النماذج وفقاً للخصائص الكتابية واللغوية يتفوق على البنى الشاملة والتعزيز عابر اللغات.

Maziar Kianimoghadam Jouneghani2026-04-24