🤖 machine learning

Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking

تقدم هذه الورقة تقنية "التقنيع الاحتمالي للكتل" (PCM)، وهي تعديل فعال حاسوبياً على التعلم التعزيزي القائم على نماذج الرؤية واللغة والأفعال (VLA) باستخدام خوارزمية (GRPO)، والتي تسرع التدريب بشكل كبير وتقلل من استهلاك الذاكرة عبر اختيار نشر التدرجات (backpropagating gradients) فقط خلال كتل المسارات التي تتباين فيها عمليات التشغيل الناجحة والفاشلة، دون الحاجة إلى نماذج مكافأة أو ناقد إضافية.

Vaidehi Bagaria, Nikshep Grampurohit, Pulkit Verma2026-05-18
💻 computer science

SoFFT: Spatial Fourier Transform for Modeling Continuum Soft Robots

تقترح هذه الورقة البحثية SoFFT، وهو إطار نمذجة مبتكر يطبق تحويل فورييه المكاني على نظرية قضيب كوسيرات لتمثيل هياكل الروبوتات اللينة المتصلة كإشارات، مما يوحد الاستراتيجيات الحالية، ويُمكّن من التقاط التشوه القائم على البيانات، ويقلل درجات الحرية مع الحفاظ على الدقة.

Daniele Caradonna, Diego Bianchi, Franco Angelini, Egidio Falotico2026-05-15
💻 computer science

Sharing the Load: Autonomous Multi-Rover Cargo Transport

تقدم هذه الورقة نظام تحكم تنبؤي بالنموذج موزع وآلية اقتران مخصصة تمكن مركبتين قمريتين ذاتيتتي القيادة من نقل حمولة تزن 475 كجم بشكل تعاوني وبدقة عالية، مما يبرهن على حل مرن للوجستيات الموائل المستقبلية.

Alexander Krawciw, Luka Antonyshyn, Sven Lilge, Nicolas Olmedo, Faizan Rehmatullah, Maxime Desjardins-Goulet, Pascal Tou (…)2026-05-15
💻 computer science

MonoSpheres: Large-Scale Monocular SLAM-Based UAV Exploration through Perception-Coupled Mapping and Planning

تقدم هذه الورقة MonoSpheres، وهو إطار عمل استكشافي جديد واسع النطاق يعتمد على الملاحة والتموضع وبناء الخرائط الآني (SLAM) أحادي الكاميرا للطائرات بدون طيار، والذي يربط بين رسم الخرائط المدرك للإدراك والتخطيط للملاحة بأمان في البيئات ثلاثية الأبعاد غير المهيكلة باستخدام كاميرا واحدة فقط، محققاً بذلك أول عرض واقعي لهذه القدرات في البيئات الخارجية.

Tomáš Musil, Matěj Petrlík, Martin Saska2026-05-15
🤖 machine learning

Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons

تقدم الورقة البحثية Robometer، وهو إطار عمل قابل للتوسع لنمذجة المكافأة يجمع بين الإشراف على التقدم على مستوى الإطار مع تعلم التفضيل القائم على مقارنة المسارات، والذي تم تدريبه على مجموعة بيانات RBM-1M واسعة النطاق لتعلم دالات مكافأة قابلة للتعميم بفعالية من مسارات خبيرة وغير مثالية متنوعة.

Anthony Liang, Yigit Korkmaz, Jiahui Zhang, Minyoung Hwang, Abrar Anwar, Sidhant Kaushik, Aditya Shah, Alex S. Huang, Lu (…)2026-05-15
💻 computer science

HECTOR: Human-centric Hierarchical Coordination and Supervision of Robotic Fleets under Continual Temporal Tasks

تقترح هذه الورقة البحثية إطار عمل "HECTOR"، وهو إطار هرمي متمحور حول الإنسان يتيح الإشراف الفعال والتنسيق الديناميكي لأساطيل الروبوتات واسعة النطاق من خلال بنية ثلاثية الطبقات مصممة للتعامل مع المهام الزمنية المستمرة وغير المؤكدة عبر تفاعل مرن بين البشر والأساطيل.

Shen Wang, Yinhang Luo, Jie Li, Meng Guo2026-05-15
💻 computer science

Terminal Matters: Kinodynamic Planning with a Terminal Cost and Learned Uncertainty in Belief State-Cost Space

تقدم هذه الورقة KiTe، وهو مخطط حركي-ديناميكي (kinodynamic planner) يعمل على تحسين جودة الحالة النهائية عبر تكلفة نهائية مُتعلمة ومسافة واسرستاين (Wasserstein distance) في فضاء الاعتقاد لتحسين موثوقية الوصول إلى الهدف تحت ظروف عدم اليقين، مع الحفاظ على الأمثلية التقاربية ودعم نماذج عدم اليقين القائمة على البيانات.

Zhuoyun Zhong, Seyedali Golestaneh, Constantinos Chamzas2026-05-15
🤖 machine learning

WarmPrior: Straightening Flow-Matching Policies with Temporal Priors

تقدم هذه الورقة "WarmPrior"، وهو مسبق (prior) مرتبط زمنياً مستمد من سجل الأفعال الأخير يحل محل المصدر الغاوسي القياسي في سياسات مطابقة التدفق (flow-matching policies) لإنتاج مسارات احتمالية أكثر استقامة، مما يؤدي باستمرار إلى تحسين معدلات النجاح، وكفاءة العينات، والاستكشاف في مهام المعالجة الروبوتية.

Sinjae Kang, Chanyoung Kim, Kaixin Wang, Li Zhao, Kimin Lee2026-05-15
💻 computer science

Ergodic Imitation for Adaptive Exploration around Demonstrations

تقترح هذه الورقة إطار محاكاة إرغودي تكيفي يعمل على بناء توزيع مستهدف من العروض التوضيحية المسترجعة لتوليد مسارات قادرة على الاستيفاء الديناميكي بين التتبع والاستكشاف، مما يمكن الروبوتات من التعافي من عدم التطابق بين التدريب والنشر وإكمال المهام رغم التغيرات البيئية أو أخطاء الملاحظة.

Ziyi Xu, Cem Bilaloglu, Yiming Li, Sylvain Calinon2026-05-15
💻 computer science

Behavior Cloning for Active Perception with Low-Resolution Egocentric Vision

تُثبت هذه الورقة أن استنساخ السلوك باستخدام رؤية ذاتية المركز منخفضة الدقة وتوقع فرق المفاصل النسبي كافٍ لتمكين ذراع روبوتية من أداء الإدراك النشط بنجاح عبر إعادة تموضع نفسها لتوسيط جسم مرئي جزئياً قبل الإمساك به.

Anthony Bilic, Chen Chen, Ladislau Bölöni2026-05-15