💻 computer science

Seeing Fast and Slow: Bimodal 3D Scene Graphs for Open-set Tasks

تقدم هذه الورقة BiMoSG، وهو إطار عمل ثنائي النمط لتوليد الرسوم البيانية للمشاهد ثلاثية الأبعاد، ينتقل ديناميكيًا بين وضع سريع وخشن ووضع آخر بطيء وذو تفاصيل دقيقة ومفتوح المفردات لتمكين تنفيذ المهام مفتوحة المجموعة بكفاءة وفي الوقت الفعلي.

Marcel Bartholomeus Prasetyo, Shrutika Vishal Thengane, A Manicka Praveen, Yi Loo, Malika Meghjani2026-06-01
💻 computer science

NTR: Neural Token Reconstruction for Scene Token Bottleneck in End-to-End Driving

تقدم هذه الورقة البحثية "إعادة بناء الرموز العصبية" (NTR)، وهو إطار عمل للقيادة من طرف إلى طرف خالٍ من الإدراك، يعزز تعلم رموز المشهد المدمجة من خلال هدف إعادة بناء مقنع بالتقطير الذاتي وعناصر دلالية مسبقة مستمدة من النماذج التأسيسية، محققاً أداءً هو الأفضل في فئته على عدة معايير مرجعية عبر إجبار عنق الزجاجة على الحفاظ على معلومات بصرية أغنى وأقل تكراراً دون تغيير المخطط أثناء وقت الاستدلال.

Jiahui Li, Jiawei Sun, Zixiang Ren, Ming Liu, Jiamin Shi, Ruiteng Zhao, Zhiyang Liu, Liying Liu, Zuoguan Wang, Kaidi Yan (…)2026-06-01
🤖 machine learning

Don't Fool Me Twice: Adapting to Adversity in the Wild with Experience-Driven Reasoning

تقترح الورقة البحثية إطار عمل للتعلم المستمر بعنوان "لا تخدعني مرتين" (Don't Fool Me Twice)، والذي يُمكّن الوكلاء المتجسدين المحمولين من التكيف مع الشدائد غير المرئية والخاصة بالتجسيد عبر الجمع بين مراقبة الاضطرابات عبر الإنترنت، والاستنتاج باستخدام نماذج الرؤية واللغة، وانحدار النواة، للتعلم من الحالات الشاذة وتحسين التخطيط والتعافي في المستقبل.

Navin Sriram Ravie, Andrew Jong, Krrish Jain, John Liu, Omar Alama, Bijo Sebastian, Sebastian Scherer2026-06-01
💬 NLP

Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration

تقدم هذه الورقة البحثية TouchSafeBench، وهو معيار مرجعي قائم على الفيزياء في Habitat 3.0 يقيم قدرة النماذج الرؤية-اللغوية على استنتاج مخاطر الاصطدام من أجل تعاون آمن بين الإنسان والروبوت، كاشفةً أن النماذج الحالية تفتقر إلى المساءلة الفيزيائية الضرية والاستدلال الهندسي الصريح للتمييز بشكل موثوق بين حالات الأمان، والاصطدام، والتلامس الوشيك.

Jun Wang, Xiaohao Xu, Xiaonan Huang2026-06-01
💻 computer science

Before Parc Fermé: RL-Time Pruning for Efficient Embodied LLMs in Autonomous Driving

تقترح الورقة البحثية استراتيجية "قبل بارك فيرميه" (BPF)، وهي استراتيجية تقليم مبتكرة تقوم بضغط النموذج بشكل تكراري أثناء التعلم التعزيزي لتحسين وحدات التحكم في النماذج اللغوية الكبيرة المتجسدة للقيادة الذاتية، محققةً توازناً فائقاً بين الأداء والذاكرة وزيادةً تصل إلى 27% في إنتاجية فك التشفير مقارنةً بالتقليم بعد التدريب أو اختيار نماذج كثيفة أصغر حجماً.

Luca Benfenati, Ali Azimi, Matteo Risso, Fabio Carapellese, Daniele Jahier Pagliari, Alessio Burrello2026-06-01
💻 computer science

Surface Constraint Policy for Learning Surface-Constrained and Dynamically Feasible Robot Skills

تقترح هذه الورقة سياسة تقييد السطح (SCP) التي تدمج نواة غاوسية موزونة ثنائية الأبعاد لترميز هندسة السطح حرة الشكل مع نموذج قائم على الانتشار ونماذج الحركة الديناميكية لتوليد أفعال روبوتية تضمن محاذاة موثوقة للسطح وإمكانية تنفيذ ديناميكية أثناء مهام المناولة المعقدة.

Shuai Ke, Jiexin Zhang, Huan Zhao, Zhiao Wei, Yikun Guo, Jie Pan, Han Ding2026-06-01
💻 computer science

LiftNav: Path Planning via Semantic Lifting in TSDF-Guided Gaussian Splatting

يُعد LiftNav إطار عمل هجين للملاحة يدمج بين تقنية Gaussian Splatting الموجهة بـ TSDF مع الرفع الدلالي في الوقت الفعلي وتحسين B-spline لتمكين تخطيط مسار آمن ومدرك للأجسام في البيئات الداخلية غير المعروفة، متفوقاً على النماذج المرجعية لمجالات الإشعاع بمعدل جدوى يصل إلى 100% ومسارات أقصر.

Hannah Schieber, Dominik Frischmann, Victor Schaack, Angela P. Schoellig, Daniel Roth2026-06-01
💻 computer science

Actuator-Aware Inverse Kinematics with Joint-Limit Admissibility for Torque-Controlled Redundant Robots

تقدم هذه الورقة طريقة لحل الكينماتيكا العكسية المدركة للمشغلات الروبوتية الزائدة عن الحاجة والمتحكم في عزم دورانها، والتي تصيغ مسألة برمجة تربيعية محدبة لتوليد أوامر سرعة المفاصل مع مراعاة حدود المفاصل وقدرات المشغلات، مما يؤدي إلى تحسين أداء المهمة المحقق دون تعديل وحدة التحكم في مستوى عزم الدوران اللاحقة.

Mohammad Dastranj, Mahdi Hejrati, Jouni Mattila2026-06-01
⚡ electrical engineering

On-Device Robotic Planning: Eliminating Inference Redundancy for Efficient Decision-Making

يقدم هذا البحث REIS، وهو إطار عمل مستوحى من الإدراك البشري يعمل على إزالة تكرار الاستنتاج في التخطيط الروبوتي على الأجهزة من خلال استغلال التكرار الزمني لتقليل زمن الاستجابة بشكل كبير مع الحفاظ على أداء تنافسي للمهام.

Joonhee Lee, Hyunseung Shin, Hyunmi Kim, Pei Zhang, Jeonggil Ko2026-06-01
💻 computer science

Batched Differentiable Rigid Body Dynamics in PyTorch for GPU-Accelerated Robot Learning

تقدم هذه الورقة BARD، وهي مكتبة PyTorch ذاتية الاحتواء ومُحسّنة لوحدات معالجة الرسومات (GPU) لديناميكيات الأجسام الصلبة القابلة للتفاضل والعمل بنظام الدفعات، والتي تتفوق بشكل كبير على الحلول الحالية المرتبطة بوحدة المعالجة المركزية (CPU) مثل Pinocchio من حيث معدل الإنتاجية وسرعة التدريب مع الحفاظ على الدقة العددية وتمكين تحديد خصائص الأنظمة القائم على التدرج بشكل فعال.

Yue Wang, Yanran Xu, Wenbo Wu, Chuanhang Qiu, Zhaoxing Li2026-06-01