📊 statistics

Entropic Projection Alignment: Estimating, Explaining, and Improving Model Performance Under Distribution Shift

تقدم هذه الورقة البحثية "محاذاة الإسقاط الإنتروبي" (EPA)، وهو إطار عمل موحد يعالج انزياح التوزيع من خلال توفير حل صريح لوزن الأهمية لتقدير أداء النموذج، وتفسير انزياحات مستوى الميزات، وتحسين دقة النطاق المستهدف من خلال مطابقة العزوم وتقليل تباعد كولباك - ليبلر (KL divergence) في آن واحد.

Salim I. Amoukou, Emanuele Albini, Tom Bewley, Saumitra Mishra, Manuela Veloso2026-06-01
🤖 AI

ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models

تقدم هذه الورقة ERGeoBench، وهو معيار تشخيصي شامل يتكون من 2,207 صورة بانورامية عالمية لمشاهد الشوارع، يقيم نماذج اللغات الكبيرة متعددة الوسائط عبر إعدادات تجسيدية تدريجية للكشف عن قيودها الحالية في الإدراك دقيق التفاصيل والتحديد الجغرافي المتري، مع تسليط الضوء على الترابط القوي بين التحديد المكاني وقدرات الاستدلال المكاني الأوسع.

Kaiwen Xue, Tao Wei, Guoxin Zhang, Zhonghong Ou, Kaoyan Lu, Yu Feng, Yifan Zhu, Haoran Luo2026-06-01
🤖 AI

Formalizing and falsifying causal pathways of rare events

تقترح هذه الورقة تعريفاً رسمياً وآثاراً قابلة للاختبار للمسارات السببية للأحداث النادرة ضمن نماذج المعادلات الهيكلية، مقدمةً تجريداً سببياً يجسّر الفجوة بين التفسيرات اللفظية والنمذجة التفصيلية من خلال التركيز على الشروط الخاصة بكل مسار بدلاً من الرسم البياني الكامل للنظام.

Anahita Haghighat, Dominik Janzing2026-06-01
📊 statistics

Why Linear Recurrent Memory Works in Partially Observable Reinforcement Learning

تقدم هذه الورقة تبريراً نظرياً لفعالية الشبكات العصبية المتكررة الخطية في التعلم التعزيزي جزئي الملاحظة من خلال إثبات أن مرشحات خطية محددة يمكنها إعادة إنتاج حالات الاعتقاد المثلى بدقة أو تحقيق خطأ قريب من الصفر في فك تشفير الحالة في نماذج ماركوف المخفية، مما يجعلها إحصاءات كافية لتعلم السياسة المثلى.

Yike Zhao, Onno Eberhard, Malek Khammassi, Ali H. Sayed, Michael Muehlebach2026-06-01
🤖 AI

Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI

تكشف هذه الدراسة أنه في حين أن السياقية وحدها تقلل من قدرة المساعد الذكي على الإقناع في مواجهة التوصيات الخبيرة، فإن الجمع بينها وبين الدفء الحواري يستعيد تأثيره، رغم أن أيًا من عنصري التصميم لا يغير بشكل ملحوظ اعتماد المستخدم، والذي يظل مرتفعًا ومدفوعًا بالثقة والوعي التقني بالذكاء الاصطناعي بدلاً من تصميم الواجهة.

Mert Yazan, Suzan Verberne, Frederik Bungaran Ishak Situmeang2026-06-01
🤖 AI

Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Agentic Systems Evaluation

تقدم الورقة البحثية GLIDE، وهي مكتبة بايثون مفتوحة المصدر توحد مختلف طرق الاستدلال المدعوم بالتنبؤ وأدوات أخذ العينات تحت واجهة برمجة تطبيقات موحدة لتمكين التقييم الموثوق وغير المنحاز للأنظمة الوكيلية مع توفير تقديرات صحيحة لعدم اليقين مع تقليل تكاليف التوسيم بشكل كبير.

Grégoire Martinon, Ibrahim Merad, Mohammed Raki2026-06-01
🤖 AI

Neither Replacement nor Panacea: Comparing LLM-Based Conversational and Graphical Decision Support in Industrial Tasks

تخلص هذه الدراسة إلى أنه في حين أن الوكلاء الحواريين القائمين على النماذج اللغوية الكبيرة يقللون من عبء العمل الذهني المتصور ويسرعون مهام اتخاذ القرار الصناعية البسيطة، إلا أنهم لا يتفوقون بشكل عام على لوحات البيانات التقليدية من حيث الدقة أو في السيناريوهات المعقدة، مما يشير إلى أن الواجهات الحوارية تقدم فوائد مشروطة بدلاً من كونها بديلاً كاملاً لتمثيلات البيانات المرئية.

Roberto Figliè, Simone Caputo, Alan Serrano, Daria Mikhaylova, Tommaso Turchi, Daniele Mazzei2026-06-01
🤖 machine learning

The Terminal Representation in Reinforcement Learning

تقدم هذه الورقة "تمثيل النهاية" (Terminal Representation - TR)، وهو بديل جديد منخفض الأبعاد لتمثيلي "الخلف" (Successor) و"الافتراضي" (Default) في التعلم المعزز، والذي يلتقط المسارات الموزونة بالمكافأة دون الحاجة إلى التفكيك الذاتي أو افتراضات الانتقال المتماثل، مما يوفر أساساً فعالاً حوسبياً لمهام مثل اكتشاف الخيارات ونقل التعلم.

Amir Esterhuysen, Anders Jonsson2026-06-01
🤖 AI

Latent Space Disentanglement via Activation Steering for Interpretable Attribute Control in Symbolic Music Generation

تقترح هذه الورقة إطار عمل لتوجيه التنشيط أثناء الاستدلال باستخدام "الفرق بين المتوسطات" و"تعامد غرام-شميدت" لتحقيق تحكم قابل للتفسير، وحتمي، ومنفصل في سمات حدة الصوت والمدة في توليد الموسيقى الرمزية القائمة على نموذج "Multitrack Music Transformer" دون الحاجة لإعادة التدريب.

Ioannis Prokopiou, Pantelis Vikatos, Maximos Kaliakatsos-Papakostas, Theodoros Giannakopoulos, Themos Stafylakis2026-06-01
🤖 AI

TraceGraph: Shared Decision Landscapes for Diagnosing and Improving Agent Trajectories

يقدم TraceGraph إطار عمل قائمًا على الرسوم البيانية يحول مسارات الوكلاء متعددة النماذج إلى مشاهد قرار مشتركة للكشف عن اختلافات الملاحة الخفية وأنماط الفشل، مما يتيح بدوره خط معالجة واعي بالفخاخ يعمل على تحسين معدلات الحل بشكل كبير في SWE-bench.

Junjie Nian, Kang Chen, Ge Zhang, Yixin Cao, Yugang Jiang2026-06-01