Topology-Driven Anti-Entanglement Control for Soft Robots
تقترح هذه الورقة إطار عمل للتعلم التعزيزي متعدد الوكلاء القائم على الطوبولوجيا (TD-MARL) يجمع بين التعلم المركزي والثوابت الطوبولوجية لتنسيق الروبوتات اللينة بفعالية لتجنب التشابك داخل البيئات شديدة القيود، مما يظهر أداءً فائقاً في التقارب ومقاومة الالتفاف مقارنة بطرق التعلم التعزيزي العميق الحالية.