🤖 machine learning

Robust Parameter Learning for Uncertain MDPs

تقترح هذه الورقة إطاراً قوياً لتعلم المعلمات لعمليات ماركوف لاتخاذ القرار غير المؤكدة، يستخدم نماذج ماركوف لاتخاذ القرار معلمية لالتقاط التبعات الجبرية بين الانتقالات، مما يولد نماذج عدم يقين أكثر إحكاماً ومدركة للتبعية من خلال تسلسل هرمي من التقريبات متعددة السطوح السليمة.

Yannik Schnitzer, Alessandro Abate, David Parker2026-05-05
🤖 machine learning

Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data

تقدم الورقة البحثية PROCO، وهو إطار عمل للتعلم المعزز الآمن غير المتصل (offline) القائم على النموذج، والذي يستفيد من النماذج اللغوية الكبيرة لترسيخ المعرفة باللغة الطبيعية في دالة تكلفة متحفظة، مما يتيح توليد عينات غير آمنة تخيلية (counterfactual) وتعلم سياسات آمنة حتى عندما تفتقر بيانات التدريب إلى الانتهاكات المرصودة.

Ruiqi Xue, Lei Yuan, Kainuo Cheng, Jing-Wen Yang, Yang Yu2026-05-05
🤖 machine learning

Decision-Focused Learning via Tangent-Space Projection of Prediction Error

تقدم هذه الورقة البحثية طريقة PEAR، وهي طريقة تعلم موجهة نحو القرار (Decision-Focused Learning) تتسم بالكفاءة الحسابية، حيث تستنتج تدرجات الندم ذات الصيغة المغلقة عن طريق إسقاط أخطاء التنبؤ على الفضاء المماسي للقيود النشطة، مما يتجنب عملية تمايز الحل (solver differentiation) المكلفة مع تحقيق جودة قرار ومتانة فائقين.

Junhyeong Lee, Sangjin Jin, Yongjae Lee2026-05-05
🤖 machine learning

Toward a foundational thermal model for residential buildings

تقدم هذه الورقة بنية "ترانسفورمر" مستوحاة من الفيزياء تدمج المعرفة بالمجال لتحقيق تنبؤات حرارية دقيقة وقابلة للتعميم عبر مختلف المباني السكنية والمناخات دون الحاجة إلى معايرة خاصة بكل مبنى، مما يظهر قدرة واعدة على نقل التعلم الصفري (zero-shot transferability) على مجموعة بيانات CityLearn.

Ting-Yu Dai, Kingsley Nweye, Dev Niyogi, Zoltan Nagy2026-05-05
⚡ electrical engineering

MU-SHOT-Fi: Self-Supervised Multi-User Wi-Fi Sensing with Source-free Unsupervised Domain Adaptation

تقترح هذه الورقة MU-SHOT-Fi، وهو إطار عمل للتكيف غير الخاضع للإشراف مع النطاق دون الحاجة للوصول إلى المصدر، يستفيد من التنبؤ بالمجموعات غير المعتمد على الترتيب، وتعظيم المعلومات الموزون بالإشغال، والتعلم الذاتي المكاني لتمكين التعرف القوي على أنشطة مستخدمي الواي فاي المتعددين عبر بيئات متنوعة دون الحاجة إلى بيانات مستهدفة مصنفة.

Ahmed Y. Radwan, Hina Tabassum2026-05-05
💬 NLP

A framework for analyzing concept representations in neural models

تقدم هذه الورقة إطارًا موحدًا لتحليل تمثيلات المفاهيم العصبية على محوري الاحتواء وفك التشابك، كاشفةً أن اختيار طريقة التقدير يؤثر بشكل كبير على هذه الخصائص، ومسلطةً الض الضوء على تحديات محددة في تعميم طرق محو المفاهيم وعزل معلومات المتحدث في نماذج الكلام.

Burin Naowarat, Hao Tang, Sharon Goldwater2026-05-05
🤖 machine learning

Quantifying Multimodal Capabilities: Formal Generalization Guarantees in Pairwise Metric Learning

تقدم هذه الورقة تحليلاً نظرياً دقيقاً لتعلم المقاييس متعدد الوسائط من خلال إنشاء علاقات هرمية لفئات الدوال واستخلاص حدود جديدة لخطأ التعميم تُظهر كيف يؤدي دمج ميزات الوسائط دقيقة التفاصيل إلى تقليل تعقيد فضاء الفرضيات وتحسين أداء النموذج.

Richeng Zhou, Xuelin Zhang, Liyuan Liu2026-05-05
🤖 machine learning

Barriers to Counterfactual Credit Attribution for Autoregressive Models

تتقصى هذه الورقة تحديات تنفيذ الإسناد الائتماني المقابل للواقع (CCA) في النماذج التوليدية ذاتية الانحدار، حيث تُظهر أن الإسناد الائتماني المقابل للواقع يفشل في التكوين ذاتي الانحدار، وأن تعديل النماذج الحالية لتلبية متطلباته يتطلب تعقيد استعلام يتناسب أسياً مع طول المخرجات.

Aloni Cohen, Chenhao Zhang2026-05-05
🤖 machine learning

Evaluating LLMs on Large-Scale Graph Property Estimation via Random Walks

تقدم هذه الورقة EstGraph، وهي مجموعة بيانات مرجعية واسعة النطاق وأربع مهام تقدير تعتمد على أخذ عينات السير العشوائي لتقييم قدرة النماذج اللغوية الكبيرة على استنتاج خصائص الرسوم البيانية الضخمة ضمن قيود طول السياق.

Sunil Kumar Maurya, Xin Liu2026-05-05
🤖 machine learning

Protein-Conditioned Multi-Objective Reinforcement Learning for Full-Length mRNA Design

تقدم الورقة البحثية ProMORNA، وهو إطار عمل للتعلم التعزيزي متعدد الأهداف يقوم بتوليد نسخ mRNA كاملة الطول من تسلسلات بروتينية مستهدفة عبر تحسين الاستقرار، وكفاءة الترجمة، والسلامة المناعية، مما يظهر أداءً فائقاً على النماذج المرجعية في أهداف غير مرئية مثل لوسيفرين اليراعة.

Zixi Shao, Tao Wang, Yibei Xiao, Tianyi Huang2026-05-05