🤖 AI

VLA Models Are More Generalizable Than You Think: Revisiting Physical and Spatial Modeling

تكشف هذه الورقة أن هشاشة منظور نماذج الرؤية واللغة والعمل (VLA) تنبع أساساً من عدم توافق النمذجة المكانية بدلاً من مشكلات النمذجة الفيزيائية، وتثبت أن طرق التكيف خفيفة الوزن وذات المحاولة الواحدة، مثل تعديل رمز الميزة والتكيف الخطي للميزات، يمكنها استعادة التعميم بفعالية مع حد أدنى من تحديثات المعلمات.

Weiqi Li, Quande Zhang, Ruifeng Zhai, Liang Lin, Guangrun Wang2026-04-01
⚡ electrical engineering

Autonomous Planning In-space Assembly Reinforcement-learning free-flYer (APIARY) International Space Station Astrobee Testing

تُفصّل هذه الورقة البحثية النجاح في العرض التجريبي لتجربة APIARY في المدار، والتي استخدمت التعلم المعزز للتحكم في الطيار الحر NASA Astrobee على متن محطة الفضاء الدولية، مما يثبت إمكانية تحقيق سلوكيات روبوتية ذاتية وسريعة في الفضاء.

Samantha Chapin, Kenneth Stewart, Roxana Leontie, Carl Glen Henshaw2026-04-01
⚡ electrical engineering

Crossing the Sim2Real Gap Between Simulation and Ground Testing to Space Deployment of Autonomous Free-flyer Control

تقدم هذه الورقة أول عرض تجريبي في المدار للتحكم الذاتي القائم على التعلم المعزز للروبوت الطائر الحر "أستروبي" (Astrobee) التابع لناسا على متن محطة الفضاء الدولية، مما يثبت نجاح مسار تدريب مبتكر من المحاكاة إلى الواقع يجسّر بنجاح الفجوة بين التدريب الأرضي والنشر في الفضاء.

Kenneth Stewart, Samantha Chapin, Roxana Leontie, Carl Glen Henshaw2026-04-01
⚡ electrical engineering

LeLaR: The First In-Orbit Demonstration of an AI-Based Satellite Attitude Controller

يُقدم هذا البحث أول عرض ناجح في المدار لمتحكم في وضعية القمر الاصطناعي يعتمد على الذكاء الاصطناعي، حيث تم نشر وكيل تعلم تعزيزي عميق تم تدريبه بالكامل في المحاكاة على القمر الاصطناعي النانوي "InnoCube" لتحقيق مناورات توجيه قصوري قوية تتفوق على متحكمات (PD) الكلاسيكية.

Kirill Djebko, Tom Baumann, Erik Dilger, Frank Puppe, Sergio Montenegro2026-04-01
💻 computer science

AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation

يُعد AGILE إطار عمل قويًا يعيد بناء التفاعلات الديناميكية بين اليد والجسم من مقاطع فيديو أحادية العين عبر الانتقال من إعادة البناء التقليدية إلى نموذج توليدي وكيل، وذلك باستخدام نموذج رؤية ولغة لتخليق شبكات مجسمة كاملة للأجسام واستراتيجية "المرساة والتتبع" لتجاوز مرحلة التهيئة الهشة القائمة على بنية الحركة من متعدد الصور، مما ينتج أصولاً جاهزة للمحاكاة ذات دقة هندسية عالية ومعقولية فيزيائية.

Jin-Chuan Shi, Binhong Ye, Tao Liu, Xiaoyang Liu, Yangjinhui Xu, Junzhe He, Zeju Li, Hao Chen, Chunhua Shen2026-04-01
💻 computer science

A Semantic Observer Layer for Autonomous Vehicles: Pre-Deployment Feasibility Study of VLMs for Low-Latency Anomaly Detection

تقترح هذه الورقة وتتحقق من دراسة جدوى ما قبل النشر لطبقة مراقب دلالي في المركبات ذاتية القيادة، مبرهنةً على أن نموذج الرؤية واللغة المكمّم (NVFP4 مع FlashAttention2) يمكنه تحقيق زمن الاستجابة المنخفض اللازم البالغ حوالي 500 مللي ثانية للاستدلال من أجل اكتشاف الشذوذ الدلالي المعتمد على السياق، مع تحديد تكميم NF4 كقيد حرج بسبب انهيار الاستدعاء.

Kunal Runwal, Swaraj Gajare, Daniel Adejumo, Omkar Ankalkope, Siddhant Baroth, Aliasghar Arab2026-04-01
💻 computer science

Bootstrap Perception Under Hardware Depth Failure for Indoor Robot Navigation

تقدم هذه الورقة نظام إدراك يعتمد على التشغيل الذاتي (bootstrap) يستفيد من بكسلات "زمن الطيران" (Time-of-Flight) الناجية لمعايرة العمق أحادي العدسة ذاتياً ودمجه انتقائياً مع ليدار ثنائي الأبعاد (2D LiDAR)، مما يتيح ملاحة روبوتية داخلية قوية مع تحسين تغطية العوائق بشكل كبير وتحقيق صفر تصادمات حتى عندما تعاني مستشعرات العمق للأجهزة من فقدان في البكسلات يصل إلى 78%.

Nishant Pushparaju, Vivek Mattam, Aliasghar Arab2026-04-01
💻 computer science

See Something, Say Something: Context-Criticality-Aware Mobile Robot Communication for Hazard Mitigations

تقدم هذه الورقة إطار عمل مدركاً لخطورة السياق للروبوتات المتنقلة ذاتية القيادة، يستفيد من الإدراك القائم على نماذج اللغة الكبيرة ونماذج الرؤية واللغة الكبيرة لتكييف درجة استعجال التواصل بشأن المخاطر ديناميكياً بناءً على العوامل الموقفية، مما يقلل أوقات الاستجابة ويزيد ثقة المستخدم مقارنة بالنماذج المرجعية ذات الأولويات الثابتة.

Bhavya Oza, Devam Shah, Ghanashyama Prabhu, Devika Kodi, Aliasghar Arab2026-04-01
💻 computer science

Why That Robot? A Qualitative Analysis of Justification Strategies for Robot Color Selection Across Occupational Contexts

تحلل هذه الورقة نوعياً أكثر من 4,000 تبرير من المستخدمين لاختيار لون الروبوت عبر سياقات مهنية مختلفة، كاشفةً أنه بينما يسود التفكير الوظيفي، فإن المستخدمين غالباً ما يربطون اختياراتهم دون وعي مع الصور النمطية العرقية والمهنية، وهو انحياز يتحول نحو التفكير المتمحور حول الآلة والمجرد من العرق كلما أصبحت الروبوتات أكثر محاكاة للبشر.

Jiangen He, Wanqi Zhang, Jessica K. Barfield2026-04-01
💻 computer science

World2Rules: A Neuro-Symbolic Framework for Learning World-Governing Safety Rules for Aviation

يُعد World2Rules إطار عمل عصبي-رمزي يتعلم قواعد سلامة قابلة للتفسير والتحقق من بيانات طيران متعددة الوسائط مشوشة، وذلك عبر الجمع بين النماذج العصبية لتوليد المرشحين والبرمجة المنطقية الاستقرائية والاستدلال الانعكاسي الهرمي لضمان الاتساق، متفوقاً بذلك على النهج العصبية البحتة والنهج العصبية-الرمزية المرجعية في الدقة.

Haichuan Wang, Jay Patrikar, Sebastian Scherer2026-04-01