💻 computer science

SI-Diff: A Framework for Learning Search and High-Precision Insertion with a Force-Domain Diffusion Policy

تقدم هذه الورقة SI-Diff، وهو إطار عمل موحد لسياسة الانتشار في مجال القوة يدمج آلية جديدة للضبط بالنمط وسياسة معلم بحث، ليتعلم في آن واحد البحث القوي والإدخال عالي الدقة، مما يحسن بشكل كبير من تحمل عدم المحاذاة وقابلية النقل في حالة الصفر مقارنة بالنماذج المرجعية الحالية.

Yibo Liu, Stanko Oparnica, Simon Shewchun-Jakaitis, Guoyi Fu, Jie Wang, Jun Yang, Anand Jagannathan, Tony Hong-Yau Lo2026-05-13
💻 computer science

SafeManip: A Property-Driven Benchmark for Temporal Safety Evaluation in Robotic Manipulation

تقدم الورقة البحثية SafeManip، وهو معيار قائم على الخصائص يستخدم المنطق الزمني الخطي عبر المسارات المحدودة (LTLf) لتقييم انتهاكات السلامة الزمنية في التلاعب الروبوتي، كاشفةً أن سياسات الرؤية واللغة والعمل عالية الأداء غالباً ما تظهر سلوكيات غير آمنة رغم تحقيق نجاح المهمة.

Chengyue Huang, Khang Vo Huynh, Sebastian Elbaum, Zsolt Kira, Lu Feng2026-05-13
⚡ electrical engineering

Cyclic Nullspace Coordination: Perpetual Flight of Aerial Carriers for Static Suspension

تقدم هذه الورقة خوارزمية قابلة للتوسع وإطاراً نظرياً يُمكّن ثلاثة أو أكثر من الناقلات الجوية من القيام برحلات مستمرة ومنسقة ودائمة مع الحفاظ على حمولة معلقة بكابل ثابت، وذلك عبر إنشاء مسارات إهليلجية ضمن فضاءات فرعية تآلفية ثنائية الأبعاد محددة مشتقة من دورة هاميلتونية على نقاط تثبيت الحمولة.

Chiara Gabellieri, Yaolei Shen, Martina Paolucci, Antonio Franchi2026-05-12
💻 computer science

GameChat: Multi-LLM Dialogue for Safe, Agile, and Socially Optimal Multi-Agent Navigation in Constrained Environments

تقدم الورقة البحثية GameChat، وهو إطار عمل جديد للملاحة متعددة الوكلاء يستفيد من التواصل باللغة الطبيعية بين النماذج اللغوية الكبيرة لتمكين حل النزاعات بشكل آمن ورشيق ومثالي اجتماعياً في البيئات المقيدة، متفوقاً بشكل كبير على النماذج المرجعية الحالية في الكفاءة والالتزام بالأولويات.

Vagul Mahadevan, Shangtong Zhang, Rohan Chandra2026-05-12
💻 computer science

Learning Agile Striker Skills for Humanoid Soccer Robots from Noisy Sensory Input

تقدم هذه الورقة إطار عمل للتعلم التعزيزي مكوناً من أربع مراحل يُمكّن الروبوتات البشرية لكرة القدم من تنفيذ ركل مستمر وقوي للكرة تحت مدخلات حسية مشوشة واضطرابات خارجية، وذلك عبر تدريب سياسة معلم باستخدام بيانات الحقيقة المطلقة وتلخيصها في سياسة طالب متكيفة من خلال التعلم التعزيزي المقيد ونمذجة الضوضاء الواقعية لسد فجوة المحاكاة إلى الواقع.

Zifan Xu, Myoungkyu Seo, Dongmyeong Lee, Hao Fu, Jiaheng Hu, Jiaxun Cui, Yuqian Jiang, Zhihan Wang, Anastasiia Brund, Jo (…)2026-05-12
💻 computer science

Large Video Planner Enables Generalizable Robot Control

تقدم هذه الورقة نموذجاً تأسيسياً للفيديو واسع النطاق، تم تدريبه على بيانات الأنشطة البشرية بمقياس الإنترنت، والذي يولد خطط فيديو بنمط "الصفر استباقي" (zero-shot) لمهام روبوتية مستحدثة، والتي يتم تحويلها بعد ذلك إلى أفعال قابلة للتنفيذ لإظهار قدرة قوية على التعميم والجدوى في العالم الحقيقي.

Boyuan Chen, Tianyuan Zhang, Haoran Geng, Caiyi Zhang, Peihao Li, Kiwhan Song, William T. Freeman, Jitendra Malik, Piete (…)2026-05-12
🤖 AI

Supervised Mixture-of-Experts for Surgical Grasping and Retraction

تقدم هذه الورقة بنية "خليط من الخبراء" (Mixture-of-Experts) خاضعة للإشراف تُمكّن سياسات التعلم بالتقليد خفيفة الوزن من تحقيق إمساك وسحب جراحي قوي وفعال من حيث البيانات على الأنسجة القابلة للتشوه باستخدام الصور التنظيرية ثلاثية الأبعاد فقط وأقل من 150 عرضاً توضيحياً، متفوقة بشكل كبير على النماذج القياسية في كل من سيناريوهات التوزيع الداخلي وسيناريوهات التوزيع الخارجي الصعبة، مع إثبات نقل ناجح لصفر من الأمثلة (zero-shot transfer) إلى عمليات جراحية على أنسجة خارج الجسم وعمليات أولية على الخنازير.

Lorenzo Mazza, Ariel Rodriguez, Rayan Younis, Martin Lelis, Ortrun Hellig, Chenpan Li, Sebastian Bodenstedt, Martin Wagn (…)2026-05-12
💻 computer science

Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models

تقترح الورقة البحثية إطار عمل "Latent Reasoning VLA" (LaRA-VLA)، وهو إطار عمل موحد يعمل على استيعاب تسلسل التفكير متعدد الوسائط ضمن تمثيلات كامنة مستمرة لتحقيق تحكم جسدي فعال وفي الوقت الفعلي مع تقليل زمن انتقال الاستدلال بنسبة تصل إلى 90% مقارنة بنهج الاستدلال الصريح.

Shuanghao Bai, Jing Lyu, Wanqi Zhou, Zhe Li, Dakai Wang, Lei Xing, Xiaoguang Zhao, Pengwei Wang, Zhongyuan Wang, Cheng C (…)2026-05-12
💻 computer science

Now You See That: Learning End-to-End Humanoid Locomotion from Raw Pixels

تقدم هذه الورقة إطار عمل متكاملًا للتنقل القوي للبشر الآليين (humanoid) القائم على الرؤية، والذي يتغلب على فجوات المحاكاة إلى الواقع من خلال محاكاة العمق عالية الدقة وتقطير السلوك، مع تمكين التكيف المتنوع مع التضاريس عبر تشكيل المكافآت المتخصص والتعلم متعدد الشبكات.

Wandong Sun, Yongbo Su, Leoric Huang, Alex Zhang, Dwyane Wei, Mu San, Daniel Tian, Ellie Cao, Baoshi Cao, Yang Liu, Finn (…)2026-05-12