💻 computer science

Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation

تقترح هذه الورقة إطار عمل للتعلم التعزيزي المقيد بالسلامة يجمع بين تحسين القيمة المشروطة للمخاطر (CVaR) أثناء التدريب والتحقق من إمكانية الوصول للشبكة العصبية بعد التدريب لضمان ملاحة روبوتية قوية، مما يثبت أن السياسات الحساسة للمخاطر تحقق هوامش سلامة رسمية وتنقلاً متفوقاً من المحاكاة إلى الواقع مقارنة بالطرق التي تعتمد فقط على مقاييس التكلفة المتوسطة.

Qisong He, Xinmiao Huang, Jinwei Hu, Zhuoyun Li, Yi Dong, Changshun Wu, Xiaowei Huang2026-05-15
💻 computer science

MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving

يُعد MAPLE إطار عمل قابلاً للتوسع وخالياً من المحاكيات، يعزز القيادة الذاتية من الطرف إلى الطرف من خلال تمكين التدريب التفاعلي متعدد الوكلاء في حلقة مغلقة داخل الفضاء الكامن لنماذج الرؤية واللغة والعمل عبر الضبط الدقيق الخاضع للإشراف والتعلم التعزيزي مع مكافآت التنوع.

Rajeev Yasarla, Deepti Hegde, Hsin-Pai Cheng, Shizhong Han, Yunxiao Shi, Meysam Sadeghigooghari, Hanno Ackermann, Litian (…)2026-05-15
⚡ electrical engineering

SeaVis: Modeling and Control of a Remotely Operated Towed Vehicle for Seabed Visualization and Mapping

تقدم هذه الورقة نموذجاً رياضياً جديداً ومنظماً تربيعياً خطياً بجدولة الكسب (LQR) لمركبة "SeaVis" المسيرة عن بعد والمقطورة، حيث تثبت من خلال محاكاة عالية الدقة أن المتحكم المقترح يتفوق على أساليب PID التقليدية في المتانة والكفاءة وتقليل التشغيل لغرض رسم خرائط قاع البحر عالية الدقة.

Abdelhakim Amer, Aske Alstrup, Frederik Rasmussen, Yury Brodskiy, Andriy Sarabakha, Erdal Kayacan2026-05-15
💻 computer science

SR-Platform: An Agentic Pipeline for Natural Language-Driven Robot Simulation Environment Synthesis

تُعد منصة SR-Platform نظاماً وكيلياً (agentic system) مُنشرًا في بيئة إنتاجية، يقوم بأتمتة تخليق بيئات محاكاة روبوتية صالحة فيزيائياً لبرنامج MuJoCo من خلال مطالبات باللغة الطبيعية عبر تنسيق توليد الأصول المدفوع بالنماذج اللغوية الكبيرة، وتخطيط التوزيع، وتجميع المشهد، محققاً متوسط زمن انتقال من البداية إلى النهاية يبلغ حوالي 50 ثانية.

Ben Wei Lim, Minh Duc Le, Thang Truong, Thanh Nguyen Canh2026-05-15
💻 computer science

SceneFunRI: Reasoning the Invisible for Task-Driven Functional Object Localization

تقدم هذه الورقة البحثية SceneFunRI، وهو معيار جديد يضم 855 حالة لتقييم قدرة نماذج الرؤية واللغة على الاستنتاج حول مواقع الأشياء الوظيفية غير المرئية أو المحجوبة باستخدام تعليمات المهام والمعرفة القائمة على المنطق العام، مما يكشف أن النماذج الحالية المتطورة تعاني بشكل كبير من هذا العجز.

Posheng Chen, Powen Cheng, Gueter Josmy Faure, Hung-Ting Su, Winston H. Hsu2026-05-15
💻 computer science

Learning Cross-Coupled and Regime Dependent Dynamics for Aerial Manipulation

تقترح هذه الورقة إطار عمل مهيكل من نوع المشفر-المفكك يجمع بين مشفر كامن غير خطي لالتقاط الديناميكيات الزمنية المترابطة تقاطعياً مع مفكك خطي خفيف الوزن للتكيف البايزي السريع والمغلق، مما يتيح معالجة جوية قوية ودقيقة في ظل ظروف تشغيل معقدة وتعتمد على الأنظمة.

Rishabh Dev Yadav, Samaksh Ujjawal, Sihao Sun, Spandan Roy, Wei Pan2026-05-15
💻 computer science

Chrono-Gymnasium: An Open-Source, Gymnasium-Compatible Distributed Simulation Framework

يُعد Chrono-Gymnasium إطار عمل موزع مفتوح المصدر يعتمد على Ray، يعمل على توسيع نطاق محاكاة Project Chrono عالية الدقة عبر مجموعات حوسبة من خلال واجهة Gymnasium معيارية، مما يقلل بشكل كبير من وقت الساعة الحقيقية لمهام الروبوتات كثيفة البيانات مثل التعلم التعزيزي والتحسين البايزي دون المساس بالدقة الفيزيائية.

Bocheng Zou, Harry Zhang, Khailanii Slaton, Jingquan Wang, Derrick Ruan, Huzaifa Mustafa Unjhawala, Radu Serban, Dan Neg (…)2026-05-15
💻 computer science

FU-MPC: Frontier- and Uncertainty-Aware Model Predictive Control for Efficient and Accurate UAV Exploration with Motorized LiDAR

تقدم هذه الورقة FU-MPC، وهو إطار استكشاف هرمي للطائرات بدون طيار المزودة بأجهزة ليدار (LiDAR) دوارة بمحركات، يعمل على تحسين تغطية الحدود وعدم اليقين في تحديد الموقع بشكل مشترك من خلال استراتيجية التحكم التنبؤي بالنموذج في الوقت الفعلي، مما يعزز كلاً من كفاءة الاستكشاف ومتانة رسم الخرائط في البيئات المعقدة.

Jianping Li, Pengfei Wan, Zhongyuan Liu, Yi Wang, Yiheng Chen, Xinhang Xu, Rui Jin, Boyu Zhou, Lihua Xie2026-05-15
⚡ electrical engineering

Behavioral Data-Driven Optimal Trajectory Generation for Rotary Cranes

تقترح هذه الورقة إطار عمل يعتمد على البيانات السلوكية بناءً على لِمّة ويليمز (Willems' fundamental lemma) لتوليد مسارات حركة دورانية (slewing) مثالية وذات حلقة مفتوحة للرافعات الدوارة، والتي تعمل بفعالية على كبح تذبذب الحمل وتقليل وقت التشغيل واستهلاك الطاقة دون الحاجة إلى نمذجة صريحة للنظام أو مجموعات بيانات واسعة.

Iskandar Khemakhem, Manuel Zobel, Johannes Schüle, Oliver Sawodny, Naoki Uchiyama, Abdallah Farrage2026-05-15