💻 computer science

CST-WM: A Causally Structured World Model for Embodied Visual Tracking

تقدم هذه الورقة البحثية نموذج العالم ذو البنية السببية CST-WM، الذي يمنع الهلوسة الناجمة عن الأفعال من خلال الفصل الصريح بين حركة الروبوت والأدلة المستهدفة في حالته الكامنة، مما يمكّن الروبوتات من التخطيط بفعالية لكل من التتبع البصري المستقر وإعادة اكتشاف الهدف في ظل الظروف الصعبة مثل الاحتجاب وحركة الجسم.

Junyi Hu, Shuaihang Yuan, Yi Fang2026-09-09
⚡ electrical engineering

Rethinking Safety for Generalist Robots

تجادل هذه الورقة بأن تعدد استخدامات الروبوتات العامة يستلزم تحولاً جذرياً من تدابير السلامة الفيزيائية التقليدية إلى إطار عمل شامل لـ "سلامة الذكاء الاصطناعي المتجسد" يعالج المخاطر المعتمدة على السياق، والمستندة إلى النوايا، والتي يصعب نمذجتها عبر دورة حياة الروبوت بأكملها.

Rohan Sinha, Anushri Dixit, Ran Tian, Anirudha Majumdar, Andrea Bajcsy2026-09-09
⚡ electrical engineering

OcclusionCBF: Backup Control Barrier Functions for Safe Navigation Among Hidden Dynamic Obstacles

تُعد OcclusionCBF مرشح سلامة يوسع وظائف حاجز التحكم الاحتياطي لضمان تجنب الاصطدام للروبوتات التي تتنقل بين العوائق الديناميكية المخفية، وذلك من خلال المصادقة على مسار احتياطي مقابل تنبؤات الإشغال القابلة للوصول، مما يضمن الجدوى التكرارية وتحسين نجاح المهام مع حد أدنى من العبء الحسابي.

Taekyung Kim, Hun Kuk Park, Renya Wada, Nikolay Atanasov, Shumon Koga, Dimitra Panagou2026-09-09
💻 computer science

Can People Distinguish Human and AI Agency in Humanoid Teleoperation? A Preliminary Study of Agency Perception

تقدم هذه الدراسة الأولية إطار عمل "الشبح في الحلقة" (Ghost-in-the-Loop) لتوضيح أن المشاركين غالباً ما يواجهون صعوبة في التمييز بين الوكالة البشرية والذكاء الاصطناعي في التشغيل الآلي للروبوتات البشرية، حيث تعتمد أحكامهم بشكل أساسي على الإدراك بمدى الطبيعية والاتساق متعدد الوسائط بدلاً من المصدر الفعلي للتحكم.

Xiang Li, Koya Dendo, Keigo Minamida, Yuto Nakamura, Per Ola Kristensson, Jun Rekimoto2026-09-09
⚡ electrical engineering

Dynamic System Emulation: Fixed Wing Dynamics on a Multicopter

تقدم هذه الورقة إطار عمل للتحكم باستخدام التخطيط الخطي للتغذية الراجعة الديناميكية لتمكين مروحية متعددة المراوح مزودة بمانع اهتزاز ثنائي المحور من محاكاة ديناميكيات طيران الطائرات ثابتة الأجنحة بدقة، مما يوفر منصة متعددة الاستخدامات لتدريب الطيارين وأبحاث الاستقلالية تتغلب على القيود الديناميكية الهوائية للطائرات التقليدية ثابتة الأجنحة.

Abdelhakim Amer, Andriy Sarabakha2026-09-09
🤖 AI

MemCorr-DP: Counterfactual Correspondence Conditioning for a Diffusion Policy Guided by a Reference

تُعد MemCorr-DP سياسة انتشار تعزز المتانة البصرية الحركية في ظل التحولات المكانية وتحولات زوايا الرؤية المركبة، وذلك عبر رفع مطابقات الميزات ثنائية الأبعاد إلى علاقات ثلاثية الأبعاد صريحة مع مسار مرجعي، وتوظيف التكييف المضاد للواقع لمواءمة الهندسة مع المشهد الحالي.

Tan Su, Haoxiang Yang, Ruxin Wang, Binghui Xie2026-09-09
⚡ electrical engineering

RoboSense: Leveraging Robotaxi Fleets as Drive-by Sensors for Urban Traffic Monitoring

تقترح هذه الورقة إطار عمل جديداً لتوجيه مركبات التاكسي ذاتي القيادة (robotaxi) بشكل ديناميكي، يستفيد من مركبات الأسطول كأجهزة استشعار تعاونية تعمل بنظام القيادة المباشرة لتحسين تغطية مراقبة حركة المرور وكفاءة السفر في آن واحد، مما يثبت أن دمج أهداف التغطية الزمكانية يمكن أن يخلق سيناريو مربحاً للطرفين لكل من إدارة حركة المرور في المناطق الحضرية وتنقل مركبات التاكسي ذاتي القيادة.

Yilin Wang, Yiheng Feng2026-09-09
💬 NLP

Contextual Observer Grounding: Evaluating Situated Spatial Reasoning in Vision-Language Models

تقدم هذه الورقة البحثية معيار "نقطة وجهة النظر" (POVBench) لتقييم قدرة نماذج الرؤية واللغة على أداء "تأصيل المراقب السياقي" — أي استنتاج منظور المتحدث الموقعي من خلال القرائن السياقية — وتُظهر أنه في حين تعاني النماذج الحالية في هذه المهمة، فإن التقسيم الصريح للاستدلال المكاني المتعلق بالمراقب يمكن أن يحسن بشكل كبير من تحديد الموقع المستهدف.

Mimo Shirasaka, Haochen Zhang, Yonatan Bisk2026-09-09
🤖 machine learning

Noisy-Space Policy Gradient for Diffusion Policies in Offline Reinforcement Learning

تقدم هذه الورقة البحثية "تدرج سياسة الفضاء الضوضائي" (NSPG)، وهو إطار عمل جديد يتيح تعلم تعزيزي غير متصل بفعالية باستخدام سياسات الانتشار عبر اشتقاق هدف منظم بـ KL على كامنات الانتشار، والذي يتم تحسينه باستخدام تقديرات قيمة فضاء العمل النظيف دون الحاجة إلى الانتشار العكسي عبر عملية إزالة الضجيج.

Mahmoud Selim, Cristina Cipriani, Karl H. Johansson2026-09-09
🤖 machine learning

Distributed Dexterous Manipulation with Spatially Conditioned Multi-Agent Transformers

تقدم هذه الورقة إطار عمل "ترانسفورمر" متعدد الوكلاء مشروط مكانيًا يتيح معالجة ماهرة موزعة وفعالة ومتينة باستخدام مصفوفة مكونة من 64 روبوتًا ناعمًا، محققًا مهام طويلة الأمد عالية الدقة في بيئات المحاكاة والواقع مع تقليل تآكل الأجهزة بشكل كبير من خلال الاختيار الأمثل للروبوتات.

Sarvesh Patil2026-09-09