⚡ electrical engineering

Neural 3D Object Reconstruction with Small-Scale Unmanned Aerial Vehicles

تقدم هذه الورقة نظاماً ذاتياً مبتكراً للطائرات بدون طيار التي يقل وزنها عن 100 جرام، يحقق إعادة بناء ثلاثي الأبعاد عالي الدقة للأجسام من خلال توظيف إطار عمل لاختيار وجهة النظر النشطة بـحلقة مغلقة للتكيف مع المسار في الوقت الفعلي، ومسار معالجة قائم على مجالات الإشعاع العصبي للرندرة النهائية الدقيقة.

Àlmos Veres-Vitàlyos, Filip Lemic, Daniel Johannes Bugelnig, Joan Bernaus Casadesús, Genis Castillo Gomez-Raya, Sergi Ab (…)2026-09-01
💻 computer science

Drift-Based Policy Optimization: Native One-Step Policy Learning for Online Robot Control

تقدم هذه الورقة البحثية تحسين السياسة القائم على الانجراف (DBPO)، وهو إطار عمل ثنائي المراحل يُمكّن سياسات توليدية أصلية ذات خطوة واحدة للتحكم الروبوتي من خلال استيعاب الصقل التكراري ضمن التدريب ودعم التعلم المعزز عبر الإنترنت، مما يحقق أداءً عالي التردد ومنخفض زمن الاستجابة يتفوق على النماذج المرجعية الحالية متعددة الخطوات والخطوة الواحدة.

Yuxuan Gao, Yedong Shen, Shiqi Zhang, Wenhao Yu, Yifan Duan, Jia pan, Jiajia Wu, Jiajun Deng, Yanyong Zhang2026-09-01
💻 computer science

One Demonstration Is Enough for Real-World Robotic Reinforcement Learning

تقدم الورقة البحثية AutoSERL، وهو إطار عمل يعمل على أتمتة التعلم المعزز للروبوتات في العالم الحقيقي باستخدام عرض توضيحي واحد من خلال دمج التوجيه بالنافذة المنزلقة، واستعادة السلامة، وآليات الإنهاء التلقائي، مما يحقق أداءً فائقاً ومتانة عبر مهام متنوعة كثيفة الاتصال مقارنة بالنماذج المرجعية الحالية.

Yuwan Liu, Hongze Yu, Song Liu, Yuhan Wang, Junge Zhang, Yaodong Yang, Yuanpei Chen, Ceyao Zhang2026-09-01
💻 computer science

FetchMan: Learning Visual Humanoid Loco-Manipulation Policies from Simulated Experiences

تقدم الورقة البحثية FetchMan، وهو مسار نقل من المحاكاة إلى الواقع (sim-to-real) متكامل النهايات يتغلب على قيود الأداء لنسخ السلوك الاصطناعي عبر تحسين السياسات باستخدام التعلم التعزيزي Flow-GRPO، مما يمكّن الروبوت البشري Unitree G1 من تحقيق نسبة نجاح 73.3% في مهام التلاعب الموضعي (loco-manipulation) في مشاهد غير مرئية مسبقاً.

Omar Rayyan, Zhi Li, Max Argus, Yuxin Jiang, Chang Yu, Chenfanfu Jiang, Yuchen Cui2026-09-01
💻 computer science

RedLight-VLA: Models for traffic-rule grounding and behavioral emphasis in driving policies

تُعد RedLight-VLA هدف تدريب مبتكر لسياسات القيادة القائمة على الرؤية واللغة والأفعال (Vision-Language-Action)، حيث تجمع بين إعادة وزن السلوك المستمد من المسار ورؤوس مساعدة متوازية لتحسين الالتزام بالقواعد والتركيز السلوكي عند التقاطعات المنظمة بالإشارات، مما يقلل بشكل كبير من تجاوز الإشارة الحمراء وأخطاء المسار دون الحاجة إلى تعليقات توضيحية يدوية إضافية للقواعد.

Bala Murali Manoghar Sai Sudhakar, Sourab Bapu Sridhar, Sandipan Das, Rahul Ahuja, Meda Lazar, Ashish Garg, Pratik Likha (…)2026-09-01
💻 computer science

Cognitively-Grounded On-Device Runtime Learning for Ground Robots in Unknown Physical Environments

تقدم هذه الورقة البحثية CogRun، وهو إطار عمل ذاتي التشغيل بالكامل يعمل على الأجهزة، يُمكّن الروبوتات الأرضية ذات المهام الحرجة للسلامة من أداء تعلم وقت التشغيل المرتكز معرفياً في بيئات غير معروفة دون خرائط مسبقة أو اتصال عبر دمج وكيل تعلم مبتكر مع وكيل عقلاني مخصص للسلامة.

Yihao Cai, Yanbing Mao, Christian Lebiere2026-09-01
💻 computer science

RoboGesture: Real-Time Semantic-aligned Co-Speech Gestures Generation for Humanoid Interaction

يُعد RoboGesture إطار عمل شاملاً يعالج ندرة البيانات، وإهمال الجانب الصوتي، والمخاوف المتعلقة بالسلامة لتمكين الروبوتات البشرية من توليد إيماءات مصاحبة للكلام في الوقت الفعلي، ومتوافقة دلالياً، وخالية من الاصطدام، وذلك من خلال مجموعة بيانات مبتكرة، ومحاذاة هرمية بين الصوت والحركة، وفلترة سلامة تعتمد على التحكم التنبؤي بالنماذج.

Zifan Wang, Ziang Ren, Pengyang Shi, Zirui Wang, Chenghuai Lin, Tianze Wang, Zekun Qi, Liangliang Zhao, He Wang, Li Yi2026-09-01
🤖 machine learning

Generation of High-Level Concepts in 3D Scene Graphs via Autoregressive Diffusion

تقترح هذه الورقة نموذجاً موحداً يعتمد على الانتشار ذاتي الانحدار (autoregressive diffusion-based model) يتعلم بشكل مشترك بنية الرسم البياني والميزات المكانية لتوليد رسوم بيانية ثلاثية الأبعاد كاملة وهرمية للمشاهد الداخلية من البدائيات الهندسية المرصودة، متفوقةً بذلك على النماذج المرجعية الحالية عبر مجموعات بيانات متنوعة ومقدمةً مقياس "غروموف-فاسترشتاين المدمج" (Fused Gromov-Wasserstein) مبتكراً للتقييم المنهجي.

Jose Andres Millan-Romera, Samuel Cognolato, Holger Voos, Jose Luis Sanchez-Lopez, Luciano Serafini2026-09-01
💻 computer science

Hydra: A Navigation World Action Model with Discrete Latent Planning and Continuous Flow-Matching Execution

تُعد Hydra إطار عمل جديد للتحكم الروبوتي يسد الفجوة بين نماذج العالم والتنفيذ في الوقت الفعلي من خلال توحيد الحالات البصرية والأفعال في فضاء كامن منفصل للتخطيط الفعال، مع استخدام مطابقة التدفق المستمر لترجمة هذه الخطط المنفصلة إلى أوامر فيزيائية سلسة.

Mohammad Nazeri, Alexandyr Card, Samira Huber, Anuj Pokhrel, Yujun Wang, Ruben Hammele, Daeun Song, Sören Pirk, Xuesu Xi (…)2026-09-01
💻 computer science

DREAM: Deployment-Time Demonstration Generation via Real-to-Sim for Scalable Policy Adaptation

إنَّ DREAM هو إطار عمل يُمكِّن التكيف القابل للتوسع لنماذج الرؤية واللغة والعمل (vision-language-action models) مع مساحات عمل جديدة من خلال التوليد التلقائي لبيانات الضبط الدقيق عبر إعادة البناء من الواقع إلى المحاكاة، وتخطيط المهام المدفوع بالنماذج اللغوية الكبيرة، ورندرة المسارات، مما يلغي الحاجة إلى عمليات التحكم عن بُعد البشرية المكلفة.

Makoto Sato, Tatsuya Matsushima, Yutaka Matsuo, Yusuke Iwasawa2026-09-01