🤖 machine learning

Online Irregular Multivariate Time Series Forecasting via Uncertainty-Driven Dual-Expert Calibration

تقترح هذه الورقة Under-Cali، وهو إطار عمل للمعايرة ثنائي الخبراء مدفوع بعدم اليقين، يتيح التنبؤ عبر الإنترنت بكفاءة واستقرار للسلاسل الزمنية متعددة المتغيرات غير المنتظمة من خلال توجيه العينات ديناميكيًا بين خبراء موثوقين وغير موثوقين بناءً على عدم اليقين المقدر، كل ذلك مع إبقاء النموذج المصدر مجمدًا.

Haonan Wen, Hanyang Chen, Songhe Feng2026-05-28
💬 NLP

Measuring Form and Function in Language Models

تقدم هذه الورقة مقياس الاختيار البديل السياقي (CAC) لتقييم النماذج اللغوية كمياً بناءً على الخصائص التركيبية الرسمية وخصائص الخطاب الوظيفية لأدوات التعيين في اللغة الإنجليزية، مما يكشف أنه بينما تستطيع بعض النماذج الضخمة جداً مضاهاة أداء الأطفال البشر في كلا المعيارين، لا يحقق أي نموذج حالي تم تدريبه على بيانات مماثلة هذا الأمر في آن واحد.

Héctor Javier Vázquez Martínez, Charles Yang2026-05-28
🤖 AI

LACUNA: Safe Agents as Recursive Program Holes

تُعدُّ LACUNA نموذج برمجة آمنًا لوكلاء النماذج اللغوية الكبيرة (LLMs)، حيث تعامل الأفعال كفجوات برمجية ذات أنواع محددة يملؤها النموذج ويتم التحقق منها عبر فحص الأنواع الساكن قبل التنفيذ، مما يوحد تدفق التحكم الخاص بالوكيل مع الكود المُولَّد مع منع حالات الفشل عند التشغيل وتقييد الوصول إلى الأدوات.

Yaoyu Zhao, Yichen Xu, Oliver Bračevac, Cao Nguyen Pham, Frank Zhengqing Wu, Martin Odersky2026-05-28
🤖 AI

AutoScientists: Self-Organizing Agent Teams for Long-Running Scientific Experimentation

تقدم الورقة البحثية "AutoScientists"، وهي فريق لامركزي من وكلاء الذكاء الاصطناعي الذين ينظمون أنفسهم ذاتياً لإجراء تجارب علمية طويلة الأمد من خلال التوليد والتحليل النقدي المتكرر للفرضيات، متفوقةً بشكل كبير على النهج الحالية أحادية الوكيل والمركزية عبر مهام تعلم الآلة في المجال الحيوي الطبي، وتحسين النماذج اللغوية، والتنبؤ بلياقة البروتين.

Shanghua Gao, Ada Fang, Marinka Zitnik2026-05-28
🤖 AI

AI in the Workplace: The Impact of AI on Perceived Job Decency and Meaningfulness

بناءً على مقابلات مع ٢٤ موظفاً في قطاعات تكنولوجيا المعلومات والخدمات والرعاية الصحية، تكشف هذه الورقة أن تأثير الذكاء الاصطناعي على الرضا الوظيفي يتباين باختلاف المجال، حيث يتوقع العاملون تغيرات متباينة في التصورات المتعلقة بكرامة العمل وجدواه، مثل توقع المتخصصين في تكنولوجيا المعلومات والرعاية الصحية تحسناً في التوازن بين العمل والحياة مع انخفاض في المكانة الاجتماعية، بينما يتوقع عمال الخدمات تحسناً في المكانة الاجتماعية رغم عدم حدوث تغيير في ساعات العمل.

Kuntal Ghosh, Marc Hassenzahl, Shadan Sadeghian2026-05-28
🤖 AI

VeriTrip: A Verifiable Benchmark for Travel Planning Agents over Unstructured Web Corpora

تقدم هذه الورقة VeriTrip، وهو معيار مرجعي قابل للتحقق يقيم وكلاء تخطيط السفر على مجموعات بيانات الويب متعددة الوسائط غير المهيكلة من خلال إنشاء قاعدة معرفية متزامنة لقياس الموثوقية الواقعية والكشف عن مقايضة حرجة بين العبء المعرفي للاسترجاع الذاتي والاحتفاظ بالتعليمات.

Yuting Xu, Jiayi Tian, Jian Liang, Xin Xiong, Hang Zhang, Mu Xu, Xiao-Yu Zhang2026-05-28
🧬 biology

Misalignment Between Backpropagation and the Hierarchy of Brain Responses to Images

تُظهر هذه الدراسة أنه في حين يمكن للتدرجات المنتشرة عكسياً من الشبكات العصبية العميقة أن تتنبأ بنشاط الدماغ البشري في المناطق البصرية العليا، إلا أن تنظيمها المكاني والزماني يختلف جوهرياً عن المعالجة الهرمية للدماغ، مما يشير إلى أن التعلم العميق والدماغ يعتمدان على الأرجح على آليات تعلم متميزة رغم اشتراكهما في محتوى تمثيلي مماثل.

Joséphine Raugel, Maximilian Seitzer, Marc Szafraniec, Huy V. Vo, Jérémy Rapin, Patrick Labatut, Piotr Bojanowski, Valen (…)2026-05-28
⚡ electrical engineering

Deep Learning Strain Estimation: Is Physics-Based Simulation the Solution?

تقترح هذه الورقة استراتيجية محاكاة جديدة قائمة على الفيزياء، معززة بفك الارتباط الحقيقي للبقع (speckle decorrelation) والتحسين التكراري، لتوليد مجموعة بيانات واقعية ضوئياً تمكن نماذج التعلم العميق من تحقيق تقدير فائق للتشوه العضلي القلبي عالمياً وإقليمياً، متجاوزةً بذلك دقة المعيار السريري الحالي.

Thierry Judge, Nicolas Duchateau, Andreas Østvik, Khuram Faraz, Anders Austlid Taskén, Sigve Karlsen, Thor Edvardsen, Ha (…)2026-05-28
🤖 AI

The Importance of Being Statistically Earnest: A Critical Re-evaluation of GSM-Symbolic

تتحدى هذه الورقة البحثية استنتاج معيار GSM-Symbolic القائل بافتقار النماذج اللغوية الكبيرة إلى القدرة على التفكير الحقيقي، وذلك من خلال إثبات أن الانخفاضات المسجلة في الأداء غالباً ما تكون غير ذات دلالة إحصائية ومربكة بسبب تحولات توزيعية غير محسوبة في نصوص المسائل، مما يكشف بدلاً من ذلك عن أن إخفاقات النماذج هي إخفاقات محددة وغير متجانسة وليست عالمية.

Dominika Agnieszka Długosz, Arlindo Oliveira, Natalia Díaz Rodríguez2026-05-28
🤖 AI

Beyond Binary Moral Judgment: Modeling Ethical Pluralism in AI

تقترح هذه الورقة إطاراً لنمذجة التعددية الأخلاقية في الذكاء الاصطناعي من خلال تمثيل الاستدلال الأخلاقي كتوزيع احتمالي عبر مجمع (simplex) للأخلاق المعيارية، وذلك باستخدام بنية دلالية ثنائية المسار وتعلم تجميعي متراكم لتحقيق دقة بلغت 88.89% في تصنيف المعضلات الأخلاقية عبر النفعية، وأخلاق الفضيلة، والواجب الأخلاقي.

Aisha Aijaz, Rahul Goel, Arnav Batra, Raghava Mutharaju2026-05-28