💻 computer science

Pre-Execution Safety Gate & Task Safety Contracts for LLM-Controlled Robot Systems

تقدم هذه الورقة SafeGate، وهي بنية سلامة عصبية رمزية (neurosymbolic) تجمع بين بوابة قرار ما قبل التنفيذ القائمة على معايير ISO 13482 وبين عقود سلامة المهام أثناء التشغيل وحل Z3 SMT، وذلك لمنع الأوامر اللغوية الطبيعية غير الآمنة من الوصول إلى أنظمة الروبوت التي يتم التحكم فيها بواسطة النماذج اللغوية الكبيرة (LLM) والتسبب في مخاطر.

Ike Obi, Vishnunandan L. N. Venkatesh, Weizheng Wang, Ruiqi Wang, Dayoon Suh, Temitope I. Amosa, Wonse Jo, Byung-Cheol M (…)2026-04-08
💻 computer science

CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment

يقدم CoEnv إطار عمل مبتكر للتعاون متعدد الوكلاء المتجسد الذي يستفيد من "بيئة تركيبية" تدمج بين مكونات العالم الحقيقي والمحاكاة لتمكين استكشاف الاستراتيجيات الآمن، وتوليد الأفعال المدفوع بنماذج اللغة والرؤية الكبيرة (VLM)، والنقل الموثوق من المحاكاة إلى الواقع لمهام المناولة المعقدة.

Li Kang, Yutao Fan, Rui Li, Heng Zhou, Yiran Qin, Zhemeng Zhang, Songtao Huang, Xiufeng Song, Zaibin Zhang, Bruno N. Y. (…)2026-04-08
💻 computer science

Referring-Aware Visuomotor Policy Learning for Closed-Loop Manipulation

تقدم هذه الورقة البحثية ReV، وهو إطار عمل لسياسة حركية بصرية ذات حلقة مغلقة يعزز المتانة في التلاعب الروبوتي من خلال الاستفوتادة من رؤوس انتشار مقترنة لدمج نقاط مرجعية متفرقة مقدمة من البشر أو المخطط ديناميكياً لإعادة تخطيط المسار في الوقت الفعلي، وكل ذلك أثناء التدريب حصرياً على عروض خبير مضطربة دون بيانات إضافية أو ضبط دقيق.

Jiahua Ma, Yiran Qin, Xin Wen, Yixiong Li, Yuyu Sun, Yulan Guo, Liang Lin, Ruimao Zhang2026-04-08
💻 computer science

Grounding Hierarchical Vision-Language-Action Models Through Explicit Language-Action Alignment

تقترح هذه الورقة إطار تدريب مبتكر يعزز شفافية الروبوت من خلال المحاذاة الصريحة بين أوصاف المهام الفرعية لنموذج الرؤية واللغة والعمل الهرمي وبين الملاحظات البصرية ومسارات العمل عبر النمذجة التباينية وتعلم التفضيلات غير المتصل بالإنترنت، محققةً أداءً يضاهي الضبط الدقيق الخاضع للإشراف الكامل مع تقليل الحاجة إلى التوصيفات المكلفة.

Theodor Wulff, Federico Tavella, Rahul Singh Maharjan, Manith Adikari, Angelo Cangelosi2026-04-08
💻 computer science

Dynamic Control Allocation for Dual-Tilt UAV Platforms

تقترح هذه الورقة إطار تحكم هرمي مع قانون تخصيص ديناميكي مبتكر لطائرات بدون طيار سداسية المروحيات ذات الإمالة المزدوجة، والذي ينمذج صراحةً تشبع المشغلات ويحسن زوايا إمالة المراوح لتحقيق تتبع قوي للمسار.

Marcello Sorge, Federico Ciresola, Giulia Michieletto, Angelo Cenedese2026-04-08
⚡ electrical engineering

Hazard Management in Robot-Assisted Mammography Support

تقدم هذه الورقة منهجية منظمة لإدارة المخاطر لنظام MammoBot للتصوير الشعاعي للثدي، والتي تجمع بين نمذجة العمليات بتوجيه من أصحاب المصلحة وبين تقنيتي SHARD وSTPA لتحديد وتخفيف مخاطر السلامة الناجمة أساساً عن عدم تطابق التوقيت وسوء تفسير الحالات بدلاً من أعطال المكونات.

Ioannis Stefanakos, Roisin Bradley, Radu Calinescu, Beverley Townsend, Tianyuan Wang, Jihong Zhu2026-04-08
⚡ electrical engineering

Force Polytope-Based Cant-Angle Selection for Tilting Hexarotor UAVs

تقترح هذه الورقة إطار تحكم خفيف الوزن للمركبات الجوية غير المأهولة سداسية المراوح ذات الميل، والتي تستخدم جدول بحث محتسب مسبقاً لمتعددات السطوح ذات القوة صفر العزم لتحسين زوايا الميل ديناميكياً لمهام التفاعل، مما يحقق تخفيضات كبيرة في وقت الحوسبة مع تحسين أداء تتبع الوضع وكفاءة التشغيل.

Alberto Piccina, Massimiliano Bertoni, Angelo Cenedese, Giulia Michieletto2026-04-08
⚡ electrical engineering

Staggered Integral Online Conformal Prediction for Safe Dynamics Adaptation with Multi-Step Coverage Guarantees

تقترح هذه الورقة خوارزمية التنبؤ المطابق المتكامل المتدرج (SI-OCP)، وهي خوارزمية مبتكرة تستخدم دالة درجة تكاملية لتوفير ضمانات تغطية طويلة المدى لتقدير عدم اليقين في النماذج في الأنظمة التكيفية دون قياسات لمشتقات الحالة، مما يتيح التكيف الآمن للديناميكيات عند دمجها مع متحكمات آمنة وحرجة مثل التحكم التنبئي بالنموذج الأنبوبي (tube MPC).

Daniel M. Cherenson, Dimitra Panagou2026-04-08
💻 computer science

Action Images: End-to-End Policy Learning via Multiview Video Generation

تقدم هذه الورقة البحثية "صور الأفعال" (Action Images)، وهو نموذج عالمي موحد للأفعال يصيغ تعلم سياسة الروبوت كعملية توليد فيديو متعدد الزوايا عبر ترجمة أفعال بسبع درجات من الحرية إلى فيديوهات أفعال مرتبطة بالبكسلات، مما يمكن العمود الفقري للفيديو من العمل كسياسة صفرية دون وحدات تحكم منفصلة، مع تحقيق أداء فائق في كل من نجاح المهام الصفرية وجودة توليد الفيديو والأفعال.

Haoyu Zhen, Zixian Gao, Qiao Sun, Yilin Zhao, Yuncong Yang, Yilun Du, Tsun-Hsuan Wang, Yi-Ling Qiao, Chuang Gan2026-04-08
🤖 AI

VERDI: VLM-Embedded Reasoning for Autonomous Driving

إن VERDI هو إطار عمل أثناء وقت التدريب يعمل على تقطير قدرات الاستدلال القائم على المنطق السليم للنماذج اللغوية البصرية الضخمة إلى مجموعات برمجية مستقلة وقابلة للتفاضل ومتكاملة من الطرف إلى الطرف للقيادة الذاتية، وذلك عبر محاذاة مخرجات الوحدات الوسيطة مع سمات الاستدلال النصي، مما يحقق سلامة وأداءً فائقين دون التكاليف العالية للاستدلال الناتجة عن نشر النماذج اللغوية البصرية الضخمة.

Bowen Feng, Zhiting Mei, Julian Ost, Filippo Ghilotti, Baiang Li, Roger Girgis, Anirudha Majumdar, Felix Heide2026-04-07