World Models for Learning Dexterous Hand-Object Interactions from Human Videos
تقدم الورقة البحثية DexWM، وهو نموذج عالمي يتعلم تفاعلات اليد والأجسام الماهرة من أكثر من 900 ساعة من فيديوهات البشر عبر استخدام نقاط مفصلية للأصابع وفقدان اتساق اليد، محققاً تنبؤاً فائقاً بالحالة المستقبلية ونقلاً صفري القدرة إلى مهام روبوتية غير مرئية مقارنة بالطرق السابقة.