Self-Supervised Video Representation Learning in a Heuristic Decoupled Perspective
تقترح هذه الورقة البحثية "التحسين ثنائي المستوى مع فك الارتباط لتعلم التباين في الفيديو" (BOD-VCL)، وهي طريقة تستفيد من نظرية كوبمان لفصل الدلالات الثابتة والديناميكية للفيديو بشكل صريح، مما يتغلب على الارتباطات الزائفة في الأطر الحالية التي تتسبب في جعل النماذج تعطي الأولوية لتعلم نوع واحد فقط من الميزات.