🤖 AI

Learning Rollout from Sampling:An R1-Style Tokenized Traffic Simulation Model

تقترح الورقة البحثية R1Sim، وهو نموذج محاكاة مروري قائم على الرموز (tokenized) يعزز السلوك المتنوع والآمن لتعدد الوكلاء من خلال الجمع بين أخذ العينات التكيفي الموجه بالإنتروبيا وتحسين السياسة النسبي للمجموعات (GRPO) للتغلب على قيود الاستكشاف في طرق التنبؤ بالرمز التالي القياسية.

Ziyan Wang, Peng Chen, Ding Li, Chiwei Li, Qichao Zhang, Zhongpu Xia, Guizhen Yu2026-03-27
💻 computer science

π\pi, But Make It Fly: Physics-Guided Transfer of VLA Models to Aerial Manipulation

تقدم هذه الورقة نظام AirVLA، الذي ينقل بنجاح نماذج الرؤية واللغة والعمل (Vision-Language-Action) المدربة مسبقاً إلى مجال المناولة الجوية من خلال الجمع بين البيانات الاصطناعية القائمة على تقنية "Gaussian Splatting" للملاحة وآلية التوجيه المدركة للحمولة التي تدمج قيود ديناميكيات الطيران في عملية أخذ العينات الخاصة بالسياسة، مما يؤدي إلى تحسين معدلات نجاح المهام في العالم الحقيقي بشكل كبير دون إعادة تدريب النموذج التأسيسي.

Johnathan Tucker, Denis Liu, Aiden Swann, Allen Ren, Javier Yu, Jiankai Sun, Brandon Kim, Lachlain McGranahan, Quan Vuon (…)2026-03-27
💻 computer science

ThermoAct:Thermal-Aware Vision-Language-Action Models for Robotic Perception and Decision-Making

تقدم هذه الورقة البحثية ThermoAct، وهو إطار عمل جديد للرؤية واللغة والعمل (Vision-Language-Action) يدمج بيانات المستشعرات الحرارية مع المدخلات البصرية واللغوية لتعزيز الإدراك الروبوتي، والسلامة، وتنفيذ المهام في بيئات التعاون بين الإنسان والروبوت.

Young-Chae Son, Dae-Kwan Ko, Yoon-Ji Choi, Soo-Chul Lim2026-03-27
⚡ electrical engineering

A Minimum-Energy Control Approach for Redundant Mobile Manipulators in Physical Human-Robot Interaction Applications

تقترح هذه الورقة وتتحقق تجريبياً من نهج تحكم بحد أدنى من الطاقة للمناولات المتنقلة ذات الفائض الحركي في التفاعل الفيزيائي بين الإنسان والروبوت، مما يثبت فاعليته في تقليل الطاقة الحركية الإجمالية للنظام وتحسين الأداء مقارنة بالطرق المرجعية خلال مهام مثل إدخال الوتد في الثقب.

Davide Tebaldi, Niccolò Paradisi, Fabio Pini, Luigi Biagiotti2026-03-27
💻 computer science

SafeGuard ASF: SR Agentic Humanoid Robot System for Autonomous Industrial Safety

تقدم هذه الورقة SafeGuard ASF، وهو إطار عمل شامل يقوم بنشر روبوتات Humanoid من طراز Unitree G1 مجهزة بإدراك متعدد الأنماط، واستدلال وكيل قائم على ReAct، وسياسات حركة مدربة بواسطة PPO، للكشف والاستجابة ذاتياً للمخاطر الصناعية مثل الحرائق، والاضطرابات الحرارية، والمتسللين في "المصانع المظلمة" غير المأهولة.

Thanh Nguyen Canh, Thang Tran Viet, Thanh Tuan Tran, Ben Wei Lim2026-03-27
🤖 AI

Integrating Deep RL and Bayesian Inference for ObjectNav in Mobile Robotics

تقترح هذه الورقة إطار عمل هجين يدمج الاستدلال البايزي للحفاظ على خرائط الاعتقاد المكاني مع التعلم التعزيزي العميق لاختيار الإجراءات، مما يظهر تحسناً في معدلات النجاح وتقليلاً في جهد البحث في مهام الملاحة الذاتية للأجسام داخل البيئات الداخلية.

João Castelo-Branco, José Santos-Victor, Alexandre Bernardino2026-03-27
🤖 AI

Modernising Reinforcement Learning-Based Navigation for Embodied Semantic Scene Graph Generation

تعمل هذه الورقة على تحديث الملاحة القائمة على التعلم المعزز لتوليد الرسوم البيانية للمشاهد الدلالية المتجسدة من خلال استبدال طريقة تحسين السياسة واعتماد تمثيل أفعال مُجزأ وأكثر دقة، مما يحسن مجتمعًا من اكتمال الرسم البياني للمشهد بنسبة 21% ويحقق توازنًا أمثلًا بين الاكتمال والكفاءة.

Roman Kueble, Marco Hueller, Mrunmai Phatak, Rainer Lienhart, Joerg Haehner2026-03-27
💻 computer science

Accurate Surface and Reflectance Modelling from 3D Radar Data with Neural Radiance Fields

تقترح هذه الورقة نهجاً ضمنياً عصبياً يستفيد من الترميز الميزاتي الهجين لنمذجة هندسة المشهد وشدة الرادار المعتمدة على الرؤية بشكل مشترك، مما يتيح إعادة بناء سطح ثلاثي الأبعاد قوي ودقيق من بيانات رادار متفرقة ومشوشة في بيئات منخفضة الرؤية.

Judith Treffler, Vladimír Kubelka, Henrik Andreasson, Martin Magnusson2026-03-27
💻 computer science

Persistent Robot World Models: Stabilizing Multi-Step Rollouts via Reinforcement Learning

تقدم هذه الورقة إطار عمل للتعلم التعزيزي لما بعد التدريب يعمل على تثبيت عمليات التوليد الذاتي متعددة الخطوات في نماذج العالم الروبوتية المشروطة بالأفعال، وذلك عبر تكييف أهداف التباين، وتوظيف مقارنات للمرشحين ذات أطوال متغيرة، واستخدام مكافآت الدقة البصرية متعددة المنظور، مما يحقق جودة تنبؤ رائدة في مجموعة بيانات DROID.

Jai Bardhan, Patrik Drozdik, Josef Sivic, Vladimir Petrik2026-03-27
💻 computer science

Intelligent Navigation and Obstacle-Aware Fabrication for Mobile Additive Manufacturing Systems

تقترح هذه الورقة منصة عالمية للطباعة والتوصيل المتنقلة تدمج التحكم في الملاحة في الوقت الفعلي مع ترسيب المواد، مما يمكّن روبوتات التصنيع المضافة المتنقلة (MAMbots) من التنقل ذاتياً في البيئات الديناميكية، وتجنب العوائق، والحفاظ على جودة تصنيع عالية من خلال نظام تغذية راجعة مغلق الحلقة.

Yifei Li, Ruizhe Fu, Huihang Liu, Guha Manogharan, Feng Ju, Ilya Kovalenko2026-03-27