💻 computer science

You Only Pose Once: A Minimalist's Detection Transformer for Monocular RGB Category-level 9D Multi-Object Pose Estimation

يُعد YOPO إطار عمل ترانسفورمر (transformer) بسيطاً أحادي المرحلة، يوحد بين كشف الأجسام ثنائي الأبعاد وتقدير الوضعية بـ 9 درجات حرية (9-DoF) على مستوى الفئة من صور RGB أحادية العدسة دون الحاجة إلى عمق زائف أو نماذج CAD، محققاً أداءً هو الأفضل في فئته على عدة معايير قياسية.

Hakjin Lee, Junghoon Seo, Jaehoon Sim2026-03-11
💻 computer science

Multi-Quadruped Cooperative Object Transport: Learning Decentralized Pinch-Lift-Move

تقدم هذه الورقة إطار عمل للتعلم اللامركزي والخالي من الاتصالات لفرق من الروبوتات رباعية الأرجل لنقل الأشياء غير القابلة للإمساك بشكل تعاوني عبر التلامس الفيزيائي وحده، وذلك باستخدام سياسة هرمية وصياغة مكافأة متخصصة لتحقيق تنسيق قوي وقابل للتوسع دون اقتران ميكانيكي صلب.

Bikram Pandit, Aayam Kumar Shrestha, Alan Fern2026-03-11
💻 computer science

Connectivity Maintenance and Recovery for Multi-Robot Motion Planning

تقترح هذه الورقة مخطط حركة يعتمد على منحنيات بيزييه (Bézier curves) باستخدام التحكم التنبئي بالنموذج (MPC) مع دالة ليابونوف المتقطعة (CLF) ودالة حاجز كلفن (CBF) في الوقت الفعلي، مما يمكّن أساطيل الروبوتات المتعددة من الحفاظ على الاتصال، والملاحة في البيئات الغنية بالعوائق دون حدوث حالات استعصاء، والتعافي من فقدان الاتصال، كما تم التحقق من ذلك من خلال المحاكاة والتجارب على ثمانية طائرات "كريزي فلاي" (Crazyflie) رباعية المراوح.

Yutong Wang, Lishuo Pan, Yichun Qu, Tengxiang Wang, Nora Ayanian2026-03-11
💻 computer science

NaviGait: Navigating Dynamically Feasible Gait Libraries using Deep Reinforcement Learning

تُعد NaviGait إطار عمل هرمي يجمع بين تحسين المسار والتعلم التعزيزي العميق لتخليق حركة ثنائية الأرجل قوية وبديهية عبر اختيار وتعديل أنماط المشي من مكتبة غير متصلة بالإنترنت بشكل طفيف، مما يؤدي إلى تبسيط تصميم المكافأة وتسريع التدريب مع الحفاظ على دقة عالية تجاه الحركات المرجعية.

Neil Janwani, Varun Madabushi, Maegan Tucker2026-03-11
🤖 AI

SynHLMA:Synthesizing Hand Language Manipulation for Articulated Object with Discrete Human Object Interaction Representation

تقدم هذه الورقة SynHLMA، وهو إطار عمل مبتكر يقوم بتوليف تسلسلات التلاعب باليد للأجسام المفصلية من خلال مواءمة تعليمات اللغة الطبيعية مع تمثيل منفصل للتفاعل بين الإنسان والشيء، مما يتيح توليد القبضات والتنبؤ بها والاستكمال بينها بشكل قوي لتطبيقات الذكاء الاصطناعي المجسد والروبوتات.

Wang zhi, Yuyan Liu, Liu Liu, Li Zhang, Ruixuan Lu, Dan Guo2026-03-11
💻 computer science

EgoMI: Learning Active Vision and Whole-Body Manipulation from Egocentric Human Demonstrations

إن EgoMI هو إطار عمل يسد الفجوة في تجسيد الإنسان والروبوت في التعلم بالتقليد من خلال التقاط مسارات متزامنة للمنفذ النهائي والرأس النشط من عروض توضيحية بشرية بمنظور الشخص الأول، واستخدام سياسة مدعومة بالذاكرة لتمكين التلاعب بالجسم بأكمله بشكل قوي على الروبوتات شبه البشرية.

Justin Yu, Yide Shentu, Di Wu, Pieter Abbeel, Ken Goldberg, Philipp Wu2026-03-11
🤖 AI

Pri4R: Learning World Dynamics for Vision-Language-Action Models with Privileged 4D Representation

تُعد Pri4R طريقة بسيطة وفعالة تعزز نماذج الرؤية واللغة والعمل (Vision-Language-Action) بفهم ضمني لديناميكيات العالم من خلال تدريبها على التنبؤ بمسارات النقاط ثلاثية الأبعاد باستخدام معلومات رباعية الأبعاد متميزة، مما يحسن بشكل كبير من أداء المناولة الفيزيائية دون إضافة أي عبء إضافي عند الاستنتاج.

Jisoo Kim, Jungbin Cho, Sanghyeok Chu, Ananya Bal, Jinhyung Kim, Gunhee Lee, Sihaeng Lee, Seung Hwan Kim, Bohyung Han, H (…)2026-03-11
🤖 machine learning

SPREAD: Subspace Representation Distillation for Lifelong Imitation Learning

تقدم الورقة البحثية SPREAD، وهو إطار عمل يحافظ على الهندسة للتعلم بالتقليد مدى الحياة، يستخدم تحليل القيم المفردة لمحاذاة تمثيلات السياسة ضمن فضاءات فرعية منخفضة الرتبة واستراتيجية تقطير موجهة بالثقة للتخفيف من النسيان الكارثي مع تحقيق أداء رائد في معيار LIBERO.

Kaushik Roy, Giovanni D'urso, Nicholas Lawrance, Brendan Tidd, Peyman Moghadam2026-03-11
💻 computer science

Adaptive SINDy: Residual Force System Identification Based UAV Disturbance Rejection

تقترح هذه الورقة إطار عمل "SINDy" التكيفي الذي يدمج بين تحديد الديناميكيات غير الخطية المتناثرة القائم على البيانات وبين التحكم التكيفي بالمربعات الصغرى المتكررة لتحديد القوى المتبقية بفعالية ورفض اضطرابات الرياح، مما يظهر أداءً فائقاً في تتبع المسار مقارنة بمتحكمات PID وINDI الأساسية على طائرة "Crazyflie" خفيفة الوزن في البيئات المضطربة.

Fawad Mehboob, Amir Atef Habel, Roohan Ahmed Khan, Mikhail Derevianchenko, Clement Fortin, Dzmitry Tsetserukou2026-03-11
⚡ electrical engineering

Formation-Aware Adaptive Conformalized Perception for Safe Leader-Follower Multi-Robot Systems

تقترح هذه الورقة إطار عمل تنبؤ متوافق تكيفي، موزع ومدرك للتشكيل، يولد حدود عدم يقين حساسة للمخاطر لفرض قيود الرؤية وضمان عمليات متعددة الروبوتات (قائد-تابع) آمنة وعالية الأداء في ظل أخطاء إدراك متباينة التباين.

Richie R. Suganda, Bin Hu2026-03-11