⚡ electrical engineering

Scheduling Analysis of UAV Flight Control Workloads using Raspberry Pi 5 Using PREEMPT_RT Linux

تُثبت هذه الورقة أنه في حين أن نواة لينكس القياسية غير مناسبة للتحكم في طيران الطائرات بدون طيار عالي التردد على جهاز Raspberry Pi 5 بسبب زمن التأخير المفرط، فإن نواة PREEMPT_RT تقلل بشكل كبير من تذبذب الأداء في أسوأ الحالات بنسبة تقارب 88%، رغم أن تباين التوقيت المتبقي يظل مدفوعاً بشكل أساسي بتنازع الذاكرة في الأجهزة.

Luiz Giacomossi, Håkan Forsberg, Ivan Tomasic, Baran Çürüklü, Tommaso Cucinotta2026-04-22
💻 computer science

Quadruped Parkour Learning: Sparsely Gated Mixture of Experts with Visual Input

تُثبت هذه الورقة أن تطبيق بنيات "خليط الخبراء" (MoE) ذات البوابات المتفرقة على سياسات التحكم القائمة على الرؤية يحسن بشكل كبير من أداء رياضة الباركور للروبوتات رباعية الأرجل على التضاريس الصعبة مقارنة بالشبكات العصبية متعددة الطبقات (MLPs) القياسية، محققةً ضعف معدل النجاح مع الحفاظ على الكفاءة الحسابية.

Michael Ziegltrum, Jianhao Jiao, Tianhu Peng, Chengxu Zhou, Dimitrios Kanoulas2026-04-22
💻 computer science

Achieving Interaction Fluidity in a Wizard-of-Oz Robotic System: A Prototype for Fluid Error-Correction

تقترح هذه الورقة معايير رئيسية لتحقيق تصحيح أخطاء سلس في أنظمة "ساحر أوز" الروبوتية، وتقدم بيئة محاكاة للواقع الافتراضي للمناولات المتنقلة مصممة لتلبية هذه المعايير.

Carlos Baptista De Lima, Julian Hough, Frank Förster, Patrick Holthaus, Yongjun Zheng2026-04-22
🤖 AI

M2^{2}GRPO: Mamba-based Multi-Agent Group Relative Policy Optimization for Biomimetic Underwater Robots Pursuit

تقترح هذه الورقة البحثية M2^{2}GRPO، وهو إطار عمل مبتكر يجمع بين سياسات قائمة على نموذج Mamba وتحسين السياسة النسبي للمجموعات (GRPO) تحت نموذج التدريب المركزي والتعلم اللامركزي (CTDE) لتعزيز اتخاذ القرار طويل الأمد، والتنسيق بين الوكلاء، واستقرار التدريب لمهام المطاردة التعاونية في الروبوتات المائية المحاكية للأنظمة البيولوجية.

Yukai Feng, Zhiheng Wu, Zhengxing Wu, Junwen Gu, Junzhi Yu2026-04-22
💻 computer science

Assessing VLM-Driven Semantic-Affordance Inference for Non-Humanoid Robot Morphologies

تستقصي هذه الورقة قدرة نماذج الرؤية واللغة (VLMs) على استنتاج الإمكانات الدلالية (semantic affordances) للروبوتات غير البشرية باستخدام مجموعة بيانات هجينة جديدة، كاشفةً عن أنه بينما تعمم هذه النماذج بشكل جيد عبر مختلف الأشكال المورفولوجية، فإنها تظهر نزعة ثابتة نحو التنبؤات المتحفظة التي تتميز بمعدلات منخفضة من الإيجابيات الكاذبة ولكن بمعدلات عالية من السلبيات الكاذبة، لا سيما في سيناريوهات استخدام الأدوات الجديدة.

Jess Jones, Raul Santos-Rodriguez, Sabine Hauert2026-04-22
💻 computer science

LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation

يُعد LiveVLN إطار عمل خالٍ من التدريب يقضي على عقبة التوقف والانطلاق في الملاحة الرؤية-اللغوية عبر تداخل التنفيذ مع معالجة الملاحظات لتمكين نشر مستمر وأكثر سلاسة في العالم الحقيقي مع الحفاظ على أداء المعايير المرجعية.

Xiangchen Wang, Weiye Zhu, Teng Wang, TianTian Geng, Zekai Zhang, Zhiyuan Qi, Jinyu Yang, Feng Zheng2026-04-22
🤖 AI

SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models

تقدم هذه الورقة SafetyALFRED، وهو معيار مرجعي جديد يوسع بيئة ALFRED عبر إضافة مخاطر مطبخية من العالم الحقيقي لتقييم النماذج اللغوية الكبيرة متعددة الوسائط، مما يكشف عن فجوة كبيرة بين قدرتها على التعرف على المخاطر الأمنية في إعدادات الإجابة على الأسئلة الثابتة وقدرتها على التخفيف من تلك المخاطر بنشاط من خلال التخطيط المتجسد.

Josue Torres-Fonseca, Naihao Deng, Yinpei Dai, Shane Storks, Yichi Zhang, Rada Mihalcea, Casey Kennington, Joyce Chai2026-04-22
🤖 AI

Multi-Cycle Spatio-Temporal Adaptation in Human-Robot Teaming

تقدم هذه الورقة البحثية إطار عمل RAPIDDS، الذي يوحد بين جدولة مستوى المهام وتكيف مستوى الحركة من خلال نمذجة السلوكيات المكانية والزمانية الفردية للبشر عبر دورات متعددة، مما يحسن بشكل كبير من كفاءة وسلامة وتفضيل المستخدم في العمل الجماعي بين الإنسان والروبوت مقارنة بالأنظمة غير التكيفية.

Alex Cuellar, Michael Hagenow, Julie Shah2026-04-22
🤖 machine learning

R3D2: Realistic 3D Asset Insertion via Diffusion for Autonomous Driving Simulation

تقدم هذه الورقة البحثية R3D2، وهو نموذج انتشار خفيف الوزن بـخطوة واحدة يتيح الإدراج الواقعي واللحظي لأصول ثلاثية الأبعاد كاملة داخل مشاهد القيادة القائمة على الرندرة العصبية، وذلك عبر توليد ظلال وإضاءة منطقية، مما يتغلب على قيود طرق "Gaussian Splatting" ثلاثية الأبعاد التقليدية من أجل محاكاة القيادة الذاتية القابلة للتوسع.

William Ljungbergh, Bernardo Taveira, Wenzhao Zheng, Adam Tonderski, Chensheng Peng, Fredrik Kahl, Christoffer Petersson (…)2026-04-21
💻 computer science

BOP-ASK: Object-Interaction Reasoning for Vision-Language Models

تقدم هذه الورقة البحثية BOP-ASK، وهي مجموعة بيانات ضخمة تضم أكثر من 150 ألف صورة و33 مليون زوج من الأسئلة والأجوبة المستمدة من أوضاع الأجسام في الفضاء ثلاثي الأبعاد (6D)، والمصممة لتدريب واختبار نماذج الرؤية واللغة في مهام الاستنتاج الدقيق للتفاعل مع الأجسام، مثل التحديد الدقيق للمواقع ثلاثية الأبعاد، والتوافق الفيزيائي، والتخطيط المكاني متعدد الخطوات.

Vineet Bhat, Sungsu Kim, Valts Blukis, Greg Heinrich, Prashanth Krishnamurthy, Ramesh Karri, Stan Birchfield, Farshad Kh (…)2026-04-21