🤖 AI

Learning Native Continuation for Action Chunking Flow Policies

تقدم الورقة البحثية Legato، وهي طريقة استمرارية أثناء وقت التدريب لنماذج الرؤية واللغة والأفعال ذات التجزئة الحركية، والتي تعيد تشكيل ديناميكيات التدفق وتستخدم التكييف بجدولة عشوائية لإنتاج مسارات أكثر سلاسة واتساقاً، متفوقة بذلك على أساليب التجزئة في الوقت الفعلي الحالية في مهام المناولة في العالم الحقيقي.

Yufeng Liu, Hang Yu, Juntu Zhao, Bocheng Li, Di Zhang, Mingzhu Li, Wenxuan Wu, Yingdong Hu, Junyuan Xie, Junliang Guo, D (…)2026-05-19
💻 computer science

VISOR: A Vision-Language Model-based Test Oracle for Testing Robots

تقدم هذه الورقة VISOR، وهو نموذج اختبار قائم على نماذج الرؤية واللغة (Vision-Language Model) يعمل على أتمتة تقييم صحة وجودة مهام الروبوت مع قياس عدم اليقين، مما يوضح أنه في حين تقدم نماذج مثل Gemini وGPT نقاط قوة أداء متكاملة، فإن تقديرات عدم اليقين الخاصة بها تفشل حاليًا في التنبؤ بشكل موثوق بصحة التقييم.

Prasun Saurabh, Pablo Valle, Aitor Arrieta, Shaukat Ali, Paolo Arcaini2026-05-19
🤖 AI

Support-Safe Variational Hybrid Filtering for Contact-Mode and Sparse-Law Recovery

تقدم هذه الورقة VHYDRO، وهو إطار عمل ترشيح هجين متغير يدعم السلامة (support-safe) يمنع فقدان التفرع في ديناميكيات الروبوت الغنية بالتلامس من خلال خلط المقترحات المتعلمة مع الانتقالات الممكنة، مما يتيح الاستدلال المشترك القوي للحالات المستمرة وأنماط التلامس المنفصلة مع تسهيل استعادة قوانين "بورت-هاميلتون" الفيزيائية المتفرقة.

Marios Papamichalis, Regina Ruane2026-05-19
🤖 AI

MR-SLAM: Immersive Spatial Supervision for Multi-Robot Mapping via Mixed Reality

تقدم الورقة البحثية نظام MR-SLAM، وهو نظام واقع مختلط يستفيد من خاصية العبور (passthrough) في جهاز Meta Quest 3 ولوحات التحكم المثبتة مكانياً لتمكين المشغلين من الإشراف والتحكم عن بُعد بفعالية على أسطول مكون من ثلاثة روبوتات لإجراء رسم خرائط متعدد الروبوتات في الوقت الفعلي مع اتساق عالٍ في الإشغال وزمن انتقال منخفض على الأجهزة الاستهلاكية.

Prakash Aryan, Cem Erdogdu, Kavinaya Kumarchokkappan, Timo Kehrer, Sebastiano Panichella2026-05-19
💻 computer science

Nori Bot: A Sub-$1,000 Floor-to-Counter Mobile Manipulator

تقدم الورقة البحثية "نوري بوت" (Nori Bot)، وهو روبوت مناور متنقل مفتوح المصدر بـ 17 درجة حرية وتكلفة تبلغ 947 دولاراً، يتغلب على قيود المنصات منخفضة التكلفة الحالية من خلال ميزة الرفع الرأسي بطول 600 ملم، والتحكم الاستباقي الذاتي عبر بيئة تشغيل "OpenClaw"، وحزمة برمجيات سلامة لمنع احتراق المحركات المؤازرة.

Antonio Li, Sungjoon Park, Wen Ni Chew2026-05-19
⚡ electrical engineering

Policy Library CBF: Finite-Horizon Safety at Runtime via Parallel Rollouts

تقترح الورقة البحثية "دالة حاجز السياسة المكتبية" (Policy Library Control Barrier Function - PL-CBF)، وهي مرشح سلامة وقت التشغيل يضمن السلامة في الأفق المحدود في البيئات غير المهيكلة من خلال تقييم مكتبة من سياسات الاحتياط عبر عمليات محاكاة متوازية لاختيار الإجراء الآمن الأقل تداخلاً، مما يوفر تغطية سلامة محسنة مقارنة بمرشحات السياسة الواحدة مع الحفاظ على سرعات تنفيذ بمستوى الميلي ثانية.

Taekyung Kim, Hideki Okamoto, Bardh Hoxha, Georgios Fainekos, Dimitra Panagou2026-05-19
🤖 machine learning

EfficientTDMPC: Improved MPC Objectives for Sample-Efficient Continuous Control

تُعد خوارزمية EfficientTDMPC خوارزمية تعلم تعزيزي قائم على النموذج وذات كفاءة في العينات، حيث تعمل على تحسين عائلة TD-MPC من خلال توظيف مجموعة من نماذج الديناميكيات مع تقديرات متوسطة للعائد وعقوبات لعدم اليقين لتحقيق أداء رائد في معايير التحكم المستمر ذات البيانات المنخفضة.

Thomas Evers, Cristian Meo, Wendelin Bohmer, Justin Dauwels, Yaniv Oren2026-05-19
💻 computer science

DriveSafer: End-to-End Autonomous Driving with Safety Guidance

يُعد DriveSafer إطار عمل سلامة مبتكر للقيادة الذاتية من الطرف إلى الطرف، حيث يوجه المخططات التوليدية صراحةً نحو سلوكيات آمنة من خلال قيود وقت التدريب وتوجيه وقت الاستدلال، مما يقلل بشكل كبير من الإخفاقات الكارثية وانتهاكات الامتثال في معيار NAVSIM مقارنة بالنماذج الرائدة.

Shounak Sural, Raj Rajkumar2026-05-19
💻 computer science

LACE: Latent Visual Representation for Cross-Embodiment Learning

إن LACE هو إطار عمل يجسّر الفجوة البصرية بين التجسيدات البشرية والآلية من خلال محاذاة تمثيلاتها البصرية الكامنة عبر ارتباطات أجزاء الجسم المتفرقة والمولدة تلقائياً، مما يمكّن الروبوتات من الاستفادة بفعالية من بيانات العروض البشرية الوفيرة لتعلم السياسات حتى مع ندرة بيانات التدريب الخاصة بالروبوت.

Yoo Sung Jang, Kanchana Ranasinghe, Cristina Mata, Yichi Zhang, Jorge Mendez-Mendez, Michael S. Ryoo2026-05-19
🤖 machine learning

Plan First, Diffuse Later: Extrinsic Graph Guidance for Long-Horizon Diffusion Planning

تقدم هذه الورقة البحثية XDiffuser، وهو نهج مبتكر يعزز التخطيط بالانتشار طويل الأمد باستخدام بحث خارجي قائم على الرسوم البيانية لتوليد خطة خفيفة الوزن توجه عملية إزالة الضجيج، مما يؤدي إلى تحسين التماسك العالمي والأداء في المهام المعقدة دون العبء الحسابي للبحث الداخلي.

Yaniv Hassidof, Adir Morgan, Yilun Du, Kiril Solovey2026-05-19