Multi-View 3D Reconstruction using Knowledge Distillation
تقترح هذه الورقة إطار عمل لتقطير المعرفة باستخدام نموذج Dust3r كمعلم لتدريب نماذج طلابية من نوع الشبكات العصبية الالتفافية (CNN) ومحولات الرؤية (Vision Transformer) بكفاءة عالية على مجموعة بيانات 12Scenes، مما يثبت أن بنية محولات الرؤية تحقق أفضل أداء في محاكة قدرات Dust3r عالية الجودة في إعادة بناء الأبعاد الثلاثية متعددة المشاهد مع تقليل التكلفة الحسابية.