CST-WM: A Causally Structured World Model for Embodied Visual Tracking
تقدم هذه الورقة البحثية نموذج العالم ذو البنية السببية CST-WM، الذي يمنع الهلوسة الناجمة عن الأفعال من خلال الفصل الصريح بين حركة الروبوت والأدلة المستهدفة في حالته الكامنة، مما يمكّن الروبوتات من التخطيط بفعالية لكل من التتبع البصري المستقر وإعادة اكتشاف الهدف في ظل الظروف الصعبة مثل الاحتجاب وحركة الجسم.