🤖 machine learning

Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter

تقترح هذه الورقة إطار عمل للتعلم التعزيزي الموجه بالمخاطر الاستباقية، والذي يستفيد من خريطة مخاطر تصادم ذاتية التنبؤ ومتوافقة اتجاهياً مشتقة من أقرب نقطة اقتراب (CPA)، لتمكين طائرة كوادتروتور من التنقل بأمان وكفاءة عبر الفوضى الديناميكية باستخدام تسلسلات العمق الموجودة على متنها فقط، محققاً بذلك نقلاً قوياً من المحاكاة إلى الواقع دون الحاجة لتدريب مسبق.

Yuchao Mei, Guohao Zhang, Luxia Ai, Haopeng Chen, Wenbing Tao2026-07-28
💻 computer science

RRTrack: Robust and Recoverable Object 6D Pose Tracking for Dynamic Scenes

يُعد RRTrack متتبعاً فعالاً وقابلاً للاسترداد للوضعية سداسية الأبعاد (6D pose) للمشاهد الديناميكية، حيث يجمع بين استراتيجية الحلقة المغلقة ثنائية الأبعاد-سداسية الأبعاد (2D-6D) ومطابقة القوالب ثنائية البنك القائمة على DINOv2 للتعامل بمتانة مع الحركة السريعة والانسداد الكامل، محققاً أداءً هو الأفضل في فئته على مقيما معياري اصطناعي جديد.

Junyue Li, Ye Zheng, Yifan Chen, Zhe Sun, Xuelong Li2026-07-28
💻 computer science

Try Once, Then Optimal: De-Redundified Procedure Memory for Cross-Episode Exploration Amortization

تقدم هذه الورقة "الذاكرة الموجهة نحو المثيل" (IOM)، وهو إطار عمل متمحور حول الكائنات يعمل على تقليل تكاليف الاستكشاف من خلال استهلاك الوقت عند التعامل مع كائنات ذات حالات خفية، وذلك عبر تسجيل وإعادة استخدام إجراءات تلاعب قصيرة بواسطة نموذج رؤية ولغة، مما يقلل بشكل كبير من عمليات الاستقصاء غير الضرورية مع الحفاظ على معدلات نجاح المهام أو تحسينها.

Haizhou Ge, Haochen Ouyang, Zhixing Chen, Yufei Jia, Yue Li, Lu Shi, Lei Han, Guyue Zhou, Ruqi Huang2026-07-28
🤖 AI

A Few Words Go a Long Way: Language Guided Robot Policy Synthesis

تقدم هذه الورقة إطار عمل ARCHITECT، الذي يستفيد من وكلاء البرمجة القائمين على النماذج اللغوية الكبيرة (LLMs) لتخليق سياسات روبوتية نمطية وقابلة للتفسير من خلال تصحيحات لغوية طبيعية تكرارية، مما يتيح مكتبة مهارات مستمرة تتفوق على نماذج الرؤية واللغة والعمل (VLA) الصندوقية السوداء في مهام المناولة المعقدة وطويلة الأمد.

Daphne Chen, Archit Ritesh Jain, Eric Goossen, Emma Romig, Michael Murray, Nick Walker, Maya Cakmak2026-07-28
💻 computer science

SHARE: Towards Head-Mounted AR with User-Centric SLAM in Shared Human-Robot Workspaces

تقدم هذه الورقة نظام SHARE، وهو نظام SLAM متمحور حول المستخدم لبيئات العمل المشتركة بين البشر والروبوتات، والذي يمنح الأولوية لتجربة مستخدم الواقع المعزز عبر ضبط أولويات الإرسال تكيفياً والاستف `%` من وفرة الميزات المرئية لتقليل زمن الاستجابة بشكل كبير مع الحفاظ على دقة تتبع عالية.

Tianyuan Du, Tianyi Hu, Hanting Ye, Maria Gorlatova2026-07-28
🤖 machine learning

WorldDiT: A Unified Diffusion Architecture for World and Action Modeling

يقدم WorldDiT بنية محول انتشار موحدة تولد في آن واحد أفعالاً مستمرة وتتنبأ بالإطارات المرئية المستقبلية، محققاً أداءً هو الأفضل في فئته عبر معايير قياسية متعددة للتلاعب الروبوتي دون الاعتماد على نماذج رؤية ولغة ضخمة مدربة مسبقاً.

Sen Wang, R. Gnana Praveen, Bidhan Roy, Marcos Villagra2026-07-28
⚡ electrical engineering

Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping

تقدم هذه الورقة "الإجراء الممكن للتحكم الأمثل" (FAOC)، وهو إطار عمل مبتكر يربط بين التعلم المعزز والتحكم الأمثل من خلال توظيف خوارزمية رسم خرائط فعالة حاسبياً لتحويل إجراءات التعلم المعزز المجردة إلى معاملات ممكنة تعتمد على الحالة، مما يضمن قيود سلامة صارمة وأداءً فائقاً في تخطيط حركة الروبوت في الوقت الفعلي دون الحاجة إلى مساحات إجراءات مصممة من قبل خبراء.

Stefan Richter, Alberto Giammarino, Guillem Torrente, Sam Blakeman, Peter Dürr2026-07-28
⚡ electrical engineering

Continual-RL for Generalization in Autonomous Racing on the RoboRacer Platform

تقترح هذه الورقة إطار عمل للتعلم التعزيزي القائم على الانتشار العكسي المستمر، والذي يُمكّن وكلاء السباق ذاتي القيادة من تعلم سياسة عامة من بيانات العالم الحقيقي والتكيف بسرعة مع المسارات الجديدة في غضون 15 دقيقة، متفوقاً بذلك على المتحكمات الكلاسيكية مع معالجة التحديات غير المستكشفة للتعلم المستمر في الروبوتات الفيزيائية.

Joel Siegert, Edoardo Ghignone, Michele Magno2026-07-28
💻 computer science

Exploring Unstructured Environments using Minimal Sensing on Cooperative Nano-Drones

تقدم هذه الورقة البحثية ExploreBug، وهو خوارزمية هجينة لخطأ نطاق الحدود (frontier range bug) تتيح للدرونات النانوية التعاونية استكشاف البيئات غير المهيكلة بكفاءة وتجنب الاصطدامات باستخدام حد أدنى من الاستشعار، وقد تم التحقق من ذلك من خلال محاكاة مكثفة وتجارب واقعية باستخدام ما يصل إلى سبع درونات.

Pedro Arias-Perez, Alvika Gautam, Miguel Fernandez-Cortizas, David Perez-Saura, Srikanth Saripalli, Pascual Campoy2026-07-27
🤖 AI

Action Flow Matching for Continual Robot Learning

تقدم هذه الورقة البحثية "مطابقة تدفق الإجراءات" (Action Flow Matching)، وهو إطار عمل توليدي يستفيد من مطابقة التدفق لتنقيح الإجراءات المخطط لها من أجل محاذاة نموذج ديناميكيات الروبوت عبر الإنترنت، مما يتيح تعلمًا مستمرًا فعالًا مع تحسين معدلات نجاح المهام مع تقليل الاعتماد على مخازن إعادة التشغيل والتخفيف من مشكلات مثل النسيان الكارثي.

Alejandro Murillo-Gonzalez, Lantao Liu2026-07-27