🤖 machine learning

Improving Reproducibility in Evaluation through Multi-Level Annotator Modeling

تتناول هذه الورقة أزمة قابلية التكرار في تقييم الذكاء الاصطناٍ التوليدي من خلال تقديم نهج تمهيد (bootstrapping) متعدد المستويات يستفيد من مجموعات بيانات واسعة النطاق ذات معرفات مقيمين ثابتة لنمذجة تباين المقيّمين وتحديد التوازن الأمثل بين عدد العناصر وعدد الاستجابات لكل عنصر المطلوب لتحقيق الدلالة الإحصائية.

Deepak Pandita, Flip Korn, Chris Welty, Christopher M. Homan2026-05-14
🤖 AI

Neurosymbolic Auditing of Natural-Language Software Requirements

تقدم هذه الورقة VERIMED، وهو مسار عمل عصبي رمزي يستفيد من النماذج اللغوية الكبيرة وحلال مشكلات التشكيل السات (SMT) لتدقيق متطلبات البرمجيات ذات اللغة الطبيعية من خلال اكتشاف الغموض عبر تنويعات الصياغة العشوائية والتحقق من الاتساق والسلامة عبر الإصلاح الموجه بالنماذج المضادة، محققاً طفرة كبيرة في دقة متطلبات سلامة الأجهزة الطبية.

Bethel Hall, William Eiers2026-05-14
🤖 AI

Harnessing Agentic Evolution

تقدم الورقة البحثية AEvo، وهو إطار عمل للتحرير الميتافيزيقي (meta-editing) يعامل التطور الوكيل (agentic evolution) كبيئة تفاعلية حيث يقوم وكيل ميتا بتحرير إجراء التطور نفسه بناءً على السياق المتراكم، مما يوحد النهج الصارمة والمرنة لتحقيق أداء رائد في مهام البحث والتحسين طويلة الأمد.

Jiayi Zhang, Yongfeng Gu, Jianhao Ruan, Maojia Song, Yiran Peng, Zhiguang Han, Jinyu Xiang, Zhitao Wang, Caiyin Yang, Yi (…)2026-05-14
🤖 AI

History Anchors: How Prior Behavior Steers LLM Decisions Toward Unsafe Actions

تكشف هذه الورقة أن النماذج اللغوية الكبيرة الرائدة، رغم محاذاتها القوية للسلامة، تظهر تأثير "مرساة التاريخ" الخطير حيث يتسبب أمر واحد بالحفاظ على الاتساق مع الأفعال الضارة السابقة في جعلها تختار الخيارات غير الآمنة بشكل ساحق، وهي ثغرة تتصاعد مع قدرة النموذج وتشكل مخاطر جسيمة لعمليات النشر الوكيلية.

Alberto G. Rodríguez Salgado2026-05-14
🤖 AI

Quantifying Sensitivity for Tree Ensembles: A symbolic and compositional approach

تقدم هذه الورقة البحثية XCount، وهو خوارزمية رمزية وتكوينية مبتكرة تقيس حساسية مجموعات أشجار القرار بكفاءة من خلال تقسيم فضاء المدخلات إلى فئات وتشفير المشكلة باستخدام مخططات القرار الجبرية، مما يحقق تسريعاً كبيراً وقابلية للتوسع مقارنة بنهج عدّ النماذج الحالية.

S. Akshay, Chaitanya Garg, Ashutosh Gupta, Kuldeep S. Meel, Ajinkya Naik2026-05-14
💬 NLP

WARDEN: Endangered Indigenous Language Transcription and Translation with 6 Hours of Training Data

تقدم هذه الورقة نظام WARDEN، وهو نظام ثنائي المراحل ينجح في نسخ وترجمة لغة واردامان المهددة بالانقراض إلى اللغة الإنجليزية باستخدام 6 ساعات فقط من بيانات التدريب عبر توظيف تهيئة نقل الفونيمات من لغة سوندا واستغلال قاموس متخصص مع نموذج لغوي كبير، متفوقاً بذلك على النماذج الموحدة الأكبر حجماً في ظروف الموارد الشحيحة للغاية.

Ziheng Zhang, Yunzhong Hou, Naijing Liu, Liang Zheng2026-05-14
🤖 AI

A Counterfactual Cause in Situation Calculus

تقترح هذه الورقة مفهومًا لسبب الإنجاز قائمًا على التخلف عن الواقع في حساب الموقف، وهو ما يعمم ويصقل الإطار الحالي الذي وضعه باتوسوف وسوتشانسكي، مع توضيح علاقته أيضًا بنظرية هالبيرن وبيرل حول السببية الفعلية، لا سيالما فيما يتعلق بالأهداف الفصلية.

Daxin Liu, Vaishak Belle2026-05-13
🤖 machine learning

Tackling Fake Forgetting through Uncertainty Quantification

تحدد هذه الورقة ظاهرة "النسيان الزائف"، حيث تفشل دقة إلغاء التعلم في اكتشاف المعلومات المحتفظ بها، وتقترح مقياساً جديداً (CR) وإطار عمل (CPU) قائماً على التنبؤ المطابق لضمان إزالة الملصق الحقيقي (ground truth label) بفعالية من مجموعة عدم اليقين الخاصة بالنموذج.

Yingdan Shi, Sijia Liu, Kaize Ding, Ren Wang2026-05-13
🤖 AI

DIPSER: A Dataset for In-Person Student Engagement Recognition in the Wild

تقدم هذه الورقة البحثية DIPSER، وهي مجموعة بيانات جديدة وشاملة في البيئات الواقعية للتعرف على تفاعل الطلاب حضورياً، والتي تجمع بشكل فريد بين بيانات كاميرا RGB متعددة الزوايا، ومقاييس مستشعرات الساعة الذكية، وتسميات متنوعة تم التحقق منها من قبل خبراء لتسهيل تحليل انتباه الطلاب وعواطفهم عبر مختلف السياقات التعليمية.

Luis Marquez-Carpintero, Sergio Suescun-Ferrandiz, Carolina Lorenzo Álvarez, Jorge Fernandez-Herrero, Diego Viejo, Rosab (…)2026-05-13