🤖 machine learning

Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback

تحل هذه الورقة الأسئلة المفتوحة المتعلقة بالتعلم عبر الإنترنت الخصمي مع الخسائر المحدبة المخفية من خلال إثبات أن خوارزمية التدرج المتناقص عبر الإنترنت (Online Gradient Descent) تحقق الندم الأمثل بمعدل O(T)\mathcal{O}(\sqrt{T}) في ظل شرط توافق هسي (Hessian compatibility condition) ضروري وكافٍ، مع وضع حد أدنى مطابق لفشلها أيضاً وتوسيع هذه النتائج لتشمل إعدادات التغذية الراجعة من نوع البانديت (bandit feedback settings).

Anas Barakat, Andreas Kontogiannis, Vasilis Pollatos, Ioannis Panageas, Antonios Varvitsiotis2026-05-27
🤖 machine learning

Function-Valued Causal Influence in Nonlinear Time Series

تجادل هذه الورقة بأن تلخيص العلاقات السببية للسلاسل الزمنية غير الخطية باستخدام درجات عددية يحجب التباينات الحرجة المعتمدة على الحالة، وتقترح بدلاً من ذلك إطاراً لتقدير التأثيرات السببية ذات القيم الدالية التي تكشف عن تأثيرات متنوعة ومحددة لكل نظام غفلت عنها الأساليب التقليدية.

Valentina V. Kuskova, Dmitry Zaytsev, Michael Coppedge2026-05-27
📊 statistics

Confounder Detection via Treatment Intent: A New Observational Study Design

تقدم هذه الورقة تصميم دراسة رصدية مبتكر يُسمى "كشف المربكات عبر نية العلاج"، والذي يستفيد من مقارنات الخبراء لأزواج المرضى المتطابقين لاستنباط المربكات غير المرصودة، ويتحقق من فعاليته في تحديد التحيزات الخفية في السجلات الصحية الإلكترونية لوحدات العناية المركزة باستخدام الملاحظات النصية السريرية كبديل لمعرفة الأطباء.

Drago Plecko, Patrik Okanovic, Torsten Hoefler, Elias Bareinboim2026-05-27
🤖 machine learning

When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Control

تقدم هذه الورقة RLScale-Bench، وهو معيار قابل للتكرار يوضح أن أداة التوسع التلقائي القائمة على القواعد والمعايرة بشكل صحيح تتفوق باستمرار على ست خوارزميات رئيسية للتعلم التعزيزي العميق في كفاءة التكلفة عبر أعباء عمل متنوعة، مما يتحدى الافتراض بأن التعلم التعزيزي العميق متفوق بطبيعته في التحكم التكيفي في الموارد.

Guilin Zhang, Chuanyi Sun, Kai Zhao, Shahryar Sarkani, John Fossaceca2026-05-27
🤖 machine learning

Amortized Factor Inference Networks for Posterior Inference

تقدم هذه الورقة شبكات الاستدلال العاملي الموزع (AFINs)، وهي بنية مبتكرة تتيح لشبكة استدلال واحدة مدربة التعميم عبر احتمالات سابقة، ودوال احتمالية، وأبعاد متفاوتة، محققةً دقة في التوزيع اللاحق تضاهي الأساليب الرائدة مع تقليل الحوسبة وقت الاختبار بمقدار 2 إلى 4 مراتب عشرية.

Joohwan Ko, Justin Domke2026-05-27
🤖 AI

Uniboost: Global Coordination with Value Alignment for Fair and Efficient Traffic Allocation

يُعد Uniboost إطار عمل موحداً لتخصيص حركة المرور لأنظمة التوصية واسعة النطاق، حيث يعزز العدالة والكفاءة من خلال تقديم آلية محاذاة القيمة اللاحقة لمعايرة درجات النموذج مع الدلالات التجارية، ونموذج تعزيز خطي مستقل لفصل مخططات الوزن المعقدة.

Ge Fan, Nan Zhao, Kai Meng, Cong Luo, Yang Fu, Huiping Chu, Jialin Liu, Yuning Jiang, Bo Zheng2026-05-27
⚡ electrical engineering

Robust Koopman Control Barrier Filters for Safe Actor-Critic Reinforcement Learning

تقدم هذه الورقة البحثية Robust Koopman-CBF SAC، وهو إطار عمل للتعلم المعزز الآمن يتعلم متنبئ Koopman القائم على البيانات لبناء وفرض قيود دالة حاجز كوبمان (CBF) مُضيّقة عبر برنامج تربيعي، مما يحقق صفر انتهاكات للقيود في الاختبارات المعيارية مع تحقيق التوازن بين أداء المهمة والسلامة.

Dhruv S. Kushwaha, Zoleikha A. Biron2026-05-27
🤖 machine learning

Diffuse to Detect: Generative Diffusion Models for Unsupervised IC Anomaly Detection

تقترح هذه الورقة أول إطار عمل غير خاضع للإشراف للكشف عن الشذوذ في الدوائر المتكاملة، والذي يستفيد من محول الانتشار (Diffusion Transformer) على بيانات اختبار مضغوطة ومجزأة (tokenized) لتحقيق أداء يضاهي أحدث ما توصل إليه العلم في تحديد العيوب الكامنة النادرة دون الحاجة إلى أمثلة مصنفة أو هندسة ميزات يدوية.

Yuxuan Yin, Chen He, Todd Jacobs, Jialei He, Boxun Xu, Robert Jin, Peng Li2026-05-27
🤖 machine learning

The Stability of Singular Distribution: A Spectral Perspective on the Two-Phase Dynamics of Language Model Pre-training

تحدد هذه الورقة "استقرار التوزيع المنفرد" (SoSD) كظاهرة طيفية جوهرية في مرحلة ما قبل التدريب للنماذج اللغوية، حيث تُثبت أن الاستقرار المبكر لطيف القيم المنفردة الموحدة يحكم الانتقال إلى مرحلة هبوط الخسارة البطيء، وتوفر إطاراً نظرياً لفهم وتحسين ديناميكيات التدريب عبر مختلف البنيات والاستراتيجيات.

Hongtao Zhang, Wenjie Zhou, Chenxi Jia, Wei Chen, Xueqi Cheng2026-05-27