MomaGraph: State-Aware Unified Scene Graphs with Vision-Language Model for Embodied Task Planning
تقدم الورقة البحثية MomaGraph، وهو تمثيل موحد لمخطط المشهد مدرك للحالة، ومجموعة بيانات وتقييم واسعة النطاق متوافقين معه، إلى جانب MomaGraph-R1، وهو نموذج لغوي بصري يستفيد من هذه الموارد لتحقيق أداء رائد في التنبؤ بمخطط المشهد الموجه للمهام وتخطيط المهام المتجسدة.