VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction
يُعد VANE إطار عمل موثوقاً للتدريب في وقت الاختبار لنماذج الرؤية واللغة والعمل، حيث يقوم بتكييف السياسات بشكل انتقائي عبر عزل التحديثات المرشحة وعدم اعتمادها إلا بعد التحقق من نجاحها من خلال التنبؤ بالتمثيل البصري المستقبلي، مما يؤدي إلى تحسين أداء التلاعب في الحلقة المغلقة.