Chasing Autonomy: Dynamic Retargeting and Control Guided RL for Performant and Controllable Humanoid Running
تقدم هذه الورقة البحثية خط إنتاج للتعلم التعزيزي يعتمد على إعادة الاستهداف الديناميكي والتوجيه بالتحكم، مما يمكّن الروبوت البشري Unitree G1 من تحقيق الجري عالي السرعة والتحمل بسرعة تصل إلى 3.3 م/ث مع تجنب العوائق ذاتياً في بيئات العالم الحقيقي.