MOSA: Motion-Guided Semantic Alignment for Dynamic Scene Graph Generation
تقترح هذه الورقة إطار عمل MoSA، وهو إطار محاذاة دلالي موجه بالحركة يعزز توليد الرسوم البيانية للمشاهد الديناميكية من خلال دمج سمات حركة أزواج الكائنات مع الميزات المكانية، ومحاذاة التمثيلات المرئية مع التضمينات النصية عبر المطابقة عبر الوسائط، واستخدام فقدان مرجح بالفئات لتحسين نمذجة العلاقات الذيلية.