💻 computer science

HoLoArm: Deformable Arms for Collision-Tolerant Quadrotor Flight

تقدم هذه الورقة البحثية HoLoArm، وهو طائرة رباعية المراوح مقاومة للاصطدام تتميز بأذرع مرنة مستوحاة من اليعسوب وسياسة تحكم بالتعلم المعزز تتيح التشوه السلبي، والتعافي السريع من الصدمات التي تصل سرعتها إلى 7.6 م/ث، والطيران المستقر مع حمولة تبلغ 540 جم في البيئات المتمحورة حول البشر.

Quang Ngoc Pham, Jonas Eschmann, Yang Zhou, Alejandro Ojeda Olarte, Giuseppe Loianno, Van Anh Ho2026-05-26
💬 NLP

When Search Becomes Memory: Turning Robot Design Trials into Transferable Skills

تقدم الورقة البحثية "Auto-Robotist"، وهو وكيل نماذج لغوية كبيرة (LLM) ذاتي التطور، يحول تصميم الروبوتات التطوري عديم الذاكرة إلى عملية قابلة للنقل عبر تقطير آثار البحث في مكتبة مهارات صريحة وقابلة للفحص بلغة طبيعية، مما يحسن كفاءة البحث بشكل كبير ويمكّن من نقل المعرفة بنجاح عبر مساحات تصميم مختلفة.

Yunfei Wang, Xiaohao Xu, Yang Li, Xiaonan Huang2026-05-26
💻 computer science

AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models

يُعد AgentGrounder إطار عمل للتوطين البصري ثلاثي الأبعاد بنمط "التعلم الصفري" (zero-shot)، يعمل مباشرة على السحب النقطية الملونة من خلال الجمع بين جدول بحث عن الكائنات يتم استخدامه دون اتصال (offline) ووكيل يعمل عبر الإنترنت (online) مدفوع بالأدوات، يقوم باسترجاع المرشحين بشكل انتقائي، وإجراء تقييم هندسي، وتفعيل عملية رندرة الصور عند الطلب لتحقيق توطين قوي مفتوح المفردات دون الحاجة إلى تدريب ثلاثي الأبعاد خاص بالمهام.

Cuong Huynh, Maxim Popov, Denis Gridusov, Sergey Kolyubin2026-05-26
💻 computer science

LRDDv3: High-Resolution Long-Range Drone Detection Dataset with Range Information and Thermal Data

تقدم هذه الورقة البحثية LRDDv3، وهي مجموعة بيانات عالية الدقة تتكون من أكثر من 100,000 صورة RGB بدقة 4K وما يقرب من 30,000 صورة حرارية مقترنة لطائرات بدون طيار تم التقاطها من مسافات طويلة في ظروف متنوعة، والمصممة لتعزيز قدرات كشف الطائرات بدون طيار بعيدة المدى.

Knut Peterson, Zaid Mayers, Azmain Yousuf, Priontu Chowdhury, Asher Zaczepinski, Solmaz Arezoomandan, Reihaneh Maarefdou (…)2026-05-26
💻 computer science

AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond

تقترح الورقة البحثية AnyScene، وهو إطار عمل موحد متمحور حول الإشغال يستفيد من محول انتشار إشغالي مكاني-زماني ووحدة توسيع منظور قائمة على الهندسة لتوليد فيديوهات قيادة متعددة المشاهد عالية الدقة، وعالية التحكم، ومتسقة زمنياً من تخطيطات رؤية علوية (BEV) عشوائية دون الاعتماد على إطارات مرجعية.

Haiming Zhang, Junfei Zhou, Feng Jiang, Jingzhong Li, Zhenglong Guo, Penglin Dai, Jifeng Dai, Yan Xie, Benjin Zhu2026-05-26
💻 computer science

Using Ensemble Diffusion to Estimate Uncertainty for End-to-End Autonomous Driving

تقدم هذه الورقة EnDfuser، وهو نظام قيادة ذاتية من طرف إلى طرف يستخدم الانتشار التجميعي لتوليد توزيع من المسارات المرشحة من بيانات الإدراك المدمجة، مما يتيح اتخاذ قرارات مدركة لعدم اليقين تعمل على تحسين أداء القيادة وقابلية التفسير على معيار LAV.

Florian Wintel, Sigmund H. Høeg, Gabriel Kiss, Frank Lindseth2026-05-25
🤖 AI

V-VLAPS: Value-Guided Planning for Vision-Language-Action Models

تقدم الورقة البحثية V-VLAPS، وهو إطار عمل للتخطيط الموجه بالقيمة يعزز نماذج الرؤية واللغة والعمل (VLA) برأس قيمة خفيف الوزن يتم تدريبه على مسارات (rollouts) غير متصلة بالإنترنت للتنبؤ بعوائد مونت كارلو، مما يحسن معدلات نجاح المهام الروبوتية طويلة المدى من خلال توجيه البحث الشجري نحو الفروع ذات القيمة الأعلى، لا سيما عند استخدام ميزانيات بحث أكبر.

Ke Ren, Ali Salamatian, Kieran Pattison, Cyrus Neary2026-05-25
💻 computer science

Remote Teleoperation of Endovascular Intervention Robots: A Systematic Review

تخلص هذه المراجعة المنهجية لست عشرة دراسة إلى أنه في حين تُظهر أنظمة الروبوتات الوعائية التي يتم التحكم فيها عن بُعد جدوى تقنية وفوائد محتملة لتقليل تعرض الأطباء وتقليل القيود على وصول المرضى، إلا أن التحقق السريري منها لا يزال محدوداً بسبب الاعتماد على النماذج الحيوانية والنماذج الوهمية، مما يستلزم إجراء المزيد من التجارب متعددة المراكز لتأكيد السلامة والفعالية في بيئات متنوعة.

Xingyu Chen, Yinchao Yang, Nikola Fischer, Harry Robertshaw, Benjamin Jackson, Mohammad Shikh-Bahaei, Christos Bergeles (…)2026-05-25
💻 computer science

Extending Deep Event Visual Odometry with Sparse Point-Cloud Export

توسع هذه الورقة البحثية إطار عمل تقدير المسافة البصرية للأحداث العميقة (DEVO) عبر إضافة مسار تصدير سحابي نقطي متفرق يقوم بتحويل البنية ثلاثية الأبعاد الداخلية للنظام إلى تمثيل هندسي صريح لأغراض التصور والمعالجة اللاحقة، محققةً دقة محلية عالية على بيانات الاختبار المرجعية مع الحفاظ على أداء تقدير المسافة الأصلي.

Alireza Safdari, Sajad Ashraf2026-05-25
💻 computer science

Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models

يُعد Agentic-VLA إطار عمل فعال للتكيف عبر الإنترنت لنماذج الرؤية واللغة والعمل، والذي يستفيد من التوليف التكيفي للمكافآت، والاستكشاف الموجه باللغة، وذاكرة الخبرة لتحسين التعميم، وكفاءة العينات، ونقل المهام عبر معايسات التلاعب الروبوتية بشكل كبير.

Ruofan Jin, Zaixi Zhang2026-05-25