🤖 machine learning

Physics-Informed Policy Optimization via Analytic Dynamics Regularization

تقدم هذه الورقة PIPER، وهو إطار عمل للتعلم التعزيزي المستند إلى الفيزياء يعزز كفاءة العينات ودقة التحكم من خلال دمج متبقي لاغرانج التفاضلي كحد تنظيم تحليلي في هدف تحسين السياسة، مما يوجه السياسات العصبية نحو حلول متسقة فيزيائياً دون تعديل المحاكيات أو الخوارزميات الموجودة.

Namai Chandra, Liu Mohan, Zhihao Gu, Lin Wang2026-03-17
💻 computer science

One-Policy-Fits-All: Geometry-Aware Action Latents for Cross-Embodiment Manipulation

تقترح الورقة البحثية إطار عمل "السياسة الواحدة التي تناسب الجميع" (OPFA)، الذي يتعلم فضاء إجراءات كامن مشترك مدرك للهندسة لتمكين سياسة واحدة من التحكم بفعالية في تجسيدات روبوتية متنوعة من خلال التدريب المشترك من الطرف إلى الطرف، مما يحسن بشكل كبير من كفاءة البيانات ونقل المهارات عبر التجسيدات المختلفة.

Juncheng Mu, Sizhe Yang, Hojin Bae, Feiyu Jia, Qingwei Ben, Boyi Li, Huazhe Xu, Jiangmiao Pang2026-03-17
🤖 machine learning

Visualizing Critic Match Loss Landscapes for Interpretation of Online Reinforcement Learning Control Algorithms

تقترح هذه الورقة طريقة لتصور وتحليل تضاريس الفقد لشبكات الناقد العصبية في التعلم التعزيزي عبر الإنترنت من خلال إسقاط مسارات المعلمات على فضاءات فرعية منخفضة الأبعاد، مما يتيح تفسيراً منهجياً لاستقرار الخوارزمية وتقاربها في مهام التحكم الديناميكي.

Jingyi Liu, Jian Guo, Eberhard Gill2026-03-17
🤖 machine learning

Adapting Critic Match Loss Landscape Visualization to Off-policy Reinforcement Learning

تُكيّف هذه الورقة طريقة تصور مشهد فضاء خسارة مطابقة الناقد (critic match loss landscape) من التعلم المعزز عبر الإنترنت (online) إلى التعلم المعزز خارج السياسة (off-policy)، وذلك من خلال مواءمتها مع تدفق البيانات القائم على الدفعات وحساب الهدف لخوارزمية "سوفت أكتور-كريتيك" (Soft Actor-Critic)، مما يوفر أداة تشخيص هندسية لتحليل ومقارنة ديناميكيات التحسين عبر سيناريوهات التحكم التقاربية والمتباعدة.

Jingyi Liu, Jian Guo, Eberhard Gill2026-03-17
🤖 machine learning

A Loss Landscape Visualization Framework for Interpreting Reinforcement Learning: An ADHDP Case Study

تقدم هذه الورقة إطار عمل لتصور تضاريس مشهد الفقد من منظور متعدد، يوضح ديناميكيات التعلم الداخلية لخوارزميات التعلم المعزز من خلال دمج أسطح فقد الناقد والممثل، وتحليل المسار، ورسم خرائط الحالة-TD، وهو ما تم إثباته من خلال دراسة حالة على متغيرات ADHDP للتحكم في وضعية المركبة الفضائية.

Jingyi Liu, Jian Guo, Eberhard Gill2026-03-17
💻 computer science

Latent Dynamics-Aware OOD Monitoring for Trajectory Prediction with Provable Guarantees

تقترح هذه الورقة إطار عمل لمراقبة خروج البيانات عن التوزيع (OOD) مدركاً للديناميكيات الكامنة للتنبؤ بالمسار في الأنظمة السيبرانية الفيزيائية ذات الأهمية الحرجة للسلامة، والذي يقوم بنمذجة تطور خطأ التوزيع الداخلي عبر نماذج ماركوف الخفية، ويوسع نهج تباعد المتوسط الأقصى التراكمي ضمن صياغة الكشف السريع عن نقطة التغيير لتحقيق ضمانات مثبتة بشأن تأخير الكشف ومعدلات الإنذار الكاذب دون الحاجة إلى معرفة صريحة بتوزيعات ما بعد التغيير.

Tongfei Guo, Lili Su2026-03-17
🤖 machine learning

Tactile Modality Fusion for Vision-Language-Action Models

تقدم الورقة البحثية TacFiLM، وهي طريقة ضبط دقيق خفيفة الوزن لما بعد التدريب تدمج الإشارات اللمسية في نماذج الرؤية واللغة والأفعال عبر التعديل الخطي المعتمد على الميزات، مما يعزز الأداء بشكل كبير في مهام المناولة الغنية بالتلامس دون العبء الحسابي للأساليب الحالية.

Charlotte Morissette, Amin Abyaneh, Wei-Di Chang, Anas Houssaini, David Meger, Hsiu-Chin Lin, Jonathan Tremblay, Gregory (…)2026-03-17
💻 computer science

Physically Accurate Rigid-Body Dynamics in Particle-Based Simulation

تقدم هذه الورقة البحثية PBD-R، وهي صيغة معدلة للديناميكا القائمة على الموضع تفرض سلوكاً دقيقاً فيزيائياً للأجسام الصلبة من خلال قيود مبتكرة للحفاظ على الزخم، مما يوفر بديلاً موحداً وفعالاً حاسوبياً للمحاكيات متعددة الحلول لتطبيقات الروبوتات.

Ava Abderezaei, Nataliya Nechyporenko, Joseph Miceli, Gilberto Briscoe-Martinez, Alessandro Roncone2026-03-17
💻 computer science

Efficient Event Camera Volume System

تقدم الورقة البحثية نظام EECVS، وهو نظام حجمي لكاميرا الأحداث التكيفية يقضي على عيوب التجميع الزمني من خلال نمذجة الأحداث كنبضات مستمرة زمنياً واختيار استراتيجيات ضغط قائمة على التحويل مثالية ديناميكياً، محققاً بذلك دقة إعادة بناء فائقة، وأداءً في الوقت الفعلي، وقدرة استثنائية على التعميم عبر مجموعات البيانات لمهام الروبوتات اللاحقة.

Juan Camilo Soto, Ian Noronha, Saru Bharti, Upinder Kaur2026-03-17
⚡ electrical engineering

Surgical Robot, Path Planning, Joint Space, Riemannian Manifolds

تقترح هذه الورقة طريقة لتخطيط المسار في فضاء المفاصل تعتمد على المتعدد المنوع الريماني للروبوتات الجراحية، والتي تستخدم نزول التدرج للتنقل بكفاءة عبر الأسطح البطنية غير المقعرة وتقليل حركة زوايا المفاصل مقارنة بحسابات فضاء الموضع التقليدية.

Yoshiki Yamamoto, Maina Sogabe, Shunichi Hirahara, Toshiki Kaisaki, Tetsuro Miyazaki, Kenji Kawashima2026-03-17