💻 computer science

Privileged Foresight Distillation: Zero-Cost Future Correction for World Action Models

تقترح هذه الورقة البحثية طريقة "تقطير الاستشراف المتميز" (Prived Foresight Distillation - PFD)، وهي طريقة تستخلص وتنقل التصحيح المشروط بالفعل والمستمد من الملاحظات المستقبلية أثناء التدريب إلى مُوائم خفيف الوزن للنماذج التي تعتمد على الملاحظات الحالية فقط، مما يحقق تحسينات مستمرة في الأداء على معايير مهام المناولة دون تكبد تكاليف التنبؤ بالمستقبل عند الاستنتاج.

Pengcheng Fang, Hongli Chen, Xiaohao Cai2026-04-29
⚡ electrical engineering

Variational Neural Belief Parameterizations for Robust Dexterous Grasping under Multimodal Uncertainty

تقترح هذه الورقة تمثيلاً بارامترياً للاشتقاق العصبي التبايني باستخدام مزيج غاوسي قابل للتفاضل وتدرجات مسارية لتحسين القبض الماهر المتين والحساس للمخاطر تحت ظروف عدم اليقين متعدد الأنماط، محققةً بذلك تعاملاً فائقاً مع مخاطر الذيل، وتخطيطاً أسرع، ومعايرة أفضل مقارنة بطرق مرشح الجسيمات وطرق تقاطع الإنتروبيا التقليدية.

Clinton Enwerem, Shreya Kalyanaraman, John S. Baras, Calin Belta2026-04-29
💻 computer science

Learning Scene-Level Signed Directional Distance Function with Ellipsoidal Priors and Neural Residuals

تقترح هذه الورقة تمثيلاً جديداً لدالة المسافة الاتجاهية الموقعة (SDDF) يجمع بين الأولويات الإهليلجية الصريحة والبواقي العصبية الضمنية لتحقيق إعادة بناء ثلاثي الأبعاد ورندرة قابلة للتفاضل تتسم بالكفاءة والدقة والاتساق الهندسي، متفوقة بذلك على الأساليب الحالية مثل NeRF وSDF وGaussian Splatting في كل من السرعة والدقة الهندسية.

Zhirui Dai, Hojoon Shin, Yulun Tian, Ki Myung Brian Lee, Nikolay Atanasov2026-04-28
💻 computer science

SLAM&Render: A Benchmark for the Intersection Between Neural Rendering, Gaussian Splatting and SLAM

تقدم الورقة البحثية SLAM&Render، وهي مجموعة بيانات مرجعية مبتكرة تم تسجيلها بواسطة ذراع روبوتية توفر بيانات متعددة الوسائط متزامنة ووضعيات حقيقية لتقييم الأساليب عند تقاطع التوطين ورسم الخرائط المتزامن (SLAM) والتحسين العصبي للصور (Neural Rendering)، مما يعالج الفجوات في مجموعات البيانات الحالية فيما يتعلق بالعمليات المتسلسلة، وتعدد الوسائط، ودقة إعادة إنتاج الحركة.

Samuel Cerezo, Gaetano Meli, Tomás Berriel Martins, Kirill Safronov, Javier Civera2026-04-28
💻 computer science

SARM: Stage-Aware Reward Modeling for Long Horizon Robot Manipulation

تقترح الورقة البحثية إطار عمل SARM، وهو نموذج مكافأة قائم على الفيديو ومعتمد على المراحل، يستفيد من التعليقات التوضيحية باللغة الطبيعية لتوليد إشراف متسق للمهام طويلة المدى والغنية بالتلامس مثل طي القمصان، مما يعزز بشكل كبير تدريب السياسات اللاحقة من خلال طريقة مبتكرة لنسخ السلوك المتوافق مع المكافأة (RA-BC).

Qianzhong Chen, Justin Yu, Mac Schwager, Pieter Abbeel, Yide Shentu, Philipp Wu2026-04-28
💻 computer science

Using Language Models as Closed-Loop High-Level Planners for Robotics Applications: A Brief Overview and Benchmarks

تستقصي هذه الورقة تجريبياً استراتيجيات عملية لدمج النماذج اللغوية الكبيرة (LLMs) ونماذج اللغة والرؤية (VLMs) كمخططات عالية المستوى ذات حلقة مغلقة في الروبوتات، حيث تحلل تحديداً تأثير أفق التحكم والبدء الدافئ لتقديم توصيات قابلة للتنفيذ لتحسين أداء التخطيط ومتانته.

Hao Wang, Sathwik Karnik, Bea Lim, Somil Bansal2026-04-28
🤖 machine learning

SPEAR-1: Scaling Beyond Robot Demonstrations via 3D Understanding

يُعد SPEAR-1 نموذجاً تأسيسياً روبوتياً يحقق تحكماً تجسيدياً فائقاً من خلال تعزيز نموذج رؤية ولغة مُدرب مسبقاً بقدرات الاستدلال المكاني ثلاثي الأبعاد المُدرَّبة على بيانات غير روبوتية واسعة النطاق وموسومة ثلاثياً، مما يسمح له بالتفوق على النماذج الرائدة مع استخدام عروض توضيحية روبوتية أقل بمقدار 20 ضعفاً.

Nikolay Nikolov, Giuliano Albanese, Sombit Dey, Aleksandar Yanev, Luc Van Gool, Jan-Nico Zaech, Danda Pani Paudel2026-04-28
🤖 machine learning

KERV: Kinematic-Rectified Speculative Decoding for Embodied VLA Models

إن KERV هو إطار عمل لفك التشفير التخميني المصحح حركياً لنماذج الرؤية واللغة والعمل (VLA)، والذي يستخدم مرشح كالمان واستراتيجية ضبط ديناميكية لتسريع استنتاج التحكم في الروبوت من خلال تعويض أخطاء الرموز عبر التنبؤات الحركية بدلاً من إعادة الاستنتاج المكلفة.

Zihao Zheng, Zhihao Mao, Maoliang Li, Jiayu Chen, Xinhao Sun, Zhaobo Zhang, Donggang Cao, Hong Mei, Xiang Chen2026-04-28
💻 computer science

SwarmDrive: Semantic V2V Coordination for Latency-Constrained Cooperative Autonomous Driving

يُعد SwarmDrive إطار عمل للتنسيق الدلالي بين المركبات (V2V) يستخدم نماذج لغوية صغيرة (SLMs) محلية واتصالات قائمة على الأحداث لتحسين معدلات نجاح القيادة الذاتية وتقليل زمن الاستجابة في السيناريوهات المحجوبة مقارنة بالنهج القائم على السحابة أو النهج المحلي البحت.

Anjie Qiu, Donglin Wang, Zexin Fang, Sanket Partani, Hans D. Schotten2026-04-28
💻 computer science

Airspeed Forward-Invariance for Unpowered Fixed-Wing Aircraft

تقترح هذه الورقة إطار عمل قائماً على القابلية للتحقق يستخدم شرط ناغومو للمماس لاستخلاص قيود تعتمد على الرياح على أوامر زاوية مسار الطيران، مما يضمن حفاظ طائرة ثابتة الأجنحة غير مدفوعة بالطاقة على غلاف سرعة جوية آمن من خلال نماذج مناورة معتمدة.

Huseyin Emre Tekaslan, Ella M. Atkins2026-04-28