💻 computer science

Failing Forward: Adaptive Failure-Informed Learning for Vision-Language-Action Models

تقدم هذه الورقة البحثية "التعلم التكيفي المستند إلى الفشل" (AFIL)، وهو إطار عمل متكامل من الطرف إلى الطرف يعزز متانة نماذج الرؤية واللغة والعمل عبر الاستفادة من مسارات الفشل المتولدة عبر الإنترنت كإرشاد سلبي تكيفي لتوجيه السياسات بعيدًا عن المناطق المعرضة للخطأ وتحسين معدلات نجاح المهام.

Meng Zheng, Samhita Marri, Anwesa Choudhuri, Benjamin Planche, Zhongpai Gao, Van Nguyen Nguyen, Terrence Chen, Girish Ch (…)2026-05-13
💻 computer science

BEACON: Cross-Domain Co-Training of Generative Robot Policies via Best-Effort Adaptation

يُعد BEACON إطار عمل قائماً على النظرية يعزز متانة وكفاءة البيانات للسياسات الروبوتية التوليدية في الإعدادات عبر المجالات من خلال صياغة التدريب المشترك كمسألة إعادة ترجيح الأهمية المدركة للاختلاف، والتي تعمل على تحسين سياسة حركية بصرية قائمة على الانتشار وأوزان المصدر لكل عينة بشكل مشترك لتقليل خطأ التعميم في المجال المستهدف.

Antong Zhang, Han Qi, Heng Yang2026-05-13
🤖 machine learning

ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network

تقترح الورقة البحثية طريقة ACSAC، وهي طريقة "ممثل-ناقد" (actor-critic) ذات حجم قطع تكيفي تستخدم شبكة "Q" قائمة على محول سببي (causal Transformer) لاختيار أحجام قطع الأفعال المثلى ديناميكيًا بناءً على العوائد المتوقعة المعتمدة على الحالة، وذلك للتغلب على قيود أحجام القطع الثابتة وتحقيق أداء رائد في مهام المناولة ذات الأفق الطويل والمكافآت الشحيحة.

Qian Chen, Junqiao Zhao, Hongtu Zhou, Hang Yu, Yanping Zhao, Chen Ye, Guang Chen2026-05-13
🤖 AI

RankQ: Offline-to-Online Reinforcement Learning via Self-Supervised Action Ranking

تُعد RankQ طريقة للتعلم التعزيزي من النوع "من عدم الاتصال إلى الاتصال" (offline-to-online) تعمل على تحسين كفاءة العينات وأداء السياسة عبر استبدال التشاؤم الموحد بخسارة ترتيب متعددة الحدود ذاتية الإشراف لتعلم تفضيلات الأفعال المهيكلة، مما يُظهر نتائج متفوقة في معايير المكافآت الشحيحة ومكاسب كبيرة في نقل المحاكاة إلى الواقع في مجال تعلم الروبوتات القائم على الرؤية.

Andrew Choi, Wei Xu2026-05-13
⚡ electrical engineering

Computational Design of a Low-Visibility UAV Using a Human-Aligned Perceptual Metric

تقدم هذه الورقة "فانتوم تويست" (Phantom Twist)، وهي طائرة بدون طيار ذات مروحة واحدة مصممة للرؤية المنخفضة من خلال ضبابية الحركة عالية السرعة، وذلك باستخدام مسار مؤتمت ثنائي المراحل يعمل على تحسين وضع المكونات لتقليل الرؤية المدركة بشرياً (عبر مقياس LPIPS) مع الالتزام الصارم بقيود استقرار الطيران، كما تم التحقق من ذلك من خلال نجاح عمليات التصنيع واختبارات الطيران.

Jingxian Wang, Chen Yu, David Matthews, Emma Alexander, Sam Kriegman, Michael Rubenstein2026-05-13
🤖 AI

Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models

تقدم هذه الورقة "تصحيح السرعة والمسار" (Pace-and-Path Correction)، وهو عامل تشغيلي وقت الاستدلال، مغلق الصيغة، ولا يتطلب تدريباً، يعالج عمى الديناميكيات الزمنية في نماذج الرؤية واللغة والعمل (Vision-Language-Action models) عبر تفكيك تعديلات الحركة إلى قناتي السرعة والمسار، مما يحسن معدلات النجاح بشكل كبير في البيئات الديناميكية دون الحاجة إلى إعادة التدريب.

Yanyan Zhang, Chaoda Song, Vikash Singh, Xinpeng Li, Kai Ye, Zhe Hu, Zhongzhu Pu, Yu Yin, Vipin Chaudhary2026-05-13
🤖 AI

Offline Policy Evaluation for Manipulation Policies via Discounted Liveness Formulation

تقترح هذه الورقة إطار عمل جديد لتقييم السياسة غير المتصلة (offline policy evaluation) للمناولة الروبوتية، والذي يستخدم مؤثر بلمان القائم على الحيوية المخصومة (discounted liveness-based Bellman operator) للتعامل بفعالية مع المكافآت الشحيحة، والتقدم غير الرتيب للمهام، وتحيز قطع الأفق المحدود، مما يؤدي إلى التفوق على الطرق الكلاسيكية في عكس تقدم المهمة بدقة.

Hao Wang, Joshua Bowden, Colton Crosby, Somil Bansal2026-05-13
💻 computer science

RIO: Flexible Real-Time Robot I/O for Cross-Embodiment Robot Learning

تقدم هذه الورقة RIO، وهو إطار عمل مفتوح المصدر بلغة بايثون مصمم للتغلب على البنية التحتية الروبوتية المجزأة من خلال توفير مكونات مرنة وخفيفة الوزن للتحكم ومعالجة البيانات عبر منصات أجهزة متنوعة، مما يتيح التدريب والنشر الفعال لنماذج الرؤية واللغة والعمل (Vision-Language-Action) المتطورة عبر مختلف الأجساء الروبوتية.

Pablo Ortega-Kral, Eliot Xing, Arthur Bucker, Vernon Luk, Junseo Kim, Owen Kwon, Angchen Xie, Nikhil Sobanbabu, Yifu Yua (…)2026-05-13
💻 computer science

Sampling-Based Follow-the-Leader Motion Planning for Manipulator-Mounted Continuum Robots

تقدم هذه الورقة مخطط حركة قائم على أخذ العينات يتيح ملاحة "اتبع القائد" (Follow-the-Leader) بكفاءة وضمان نظري للروبوتات المستمرة المثبتة على أذرع آلية كاملة التوجيه، وذلك عبر فصل البحث عن الشكل العالمي عن تحديد وضعية القاعدة من خلال بناء هندسي ذي صيغة مغلقة.

Chengnan Shentu, Nicholas Baldassini, Oluwagbotemi D. Iseoluwa, Radian Gondokaryono, Jessica Burgner-Kahrs2026-05-13
🤖 AI

Weather-Robust Cross-View Geo-Localization via Prototype-Based Semantic Part Discovery

تقدم الورقة البحثية SkyPart، وهو نموذج أولي خفيف الوزن لاكتشاف الأجزاء الدلالية يعتمد على النماذج الأولية (prototype-based) لشبكات المحولات الرؤيوية (vision transformers)، والذي يحقق أفضل النتائج الحالية في تحديد المواقع الجغرافية عبر الرؤى المختلفة والمتينة تجاه الظروف الجوية من خلال الفصل الصريح بين التخطيط والنسيج، وتهميش تباينات الارتفاع، واستخدام تدريب متعدد الأهداف بوزن عدم اليقين.

Chi-Nguyen Tran, Dao Sy Duy Minh, Huynh Trung Kiet, Nguyen Lam Phu Quy, Phu-Hoa Pham, Long Tran-Thanh2026-05-13