MicroViTv2: Beyond the FLOPS for Edge Energy-Friendly Vision Transformers
تُعد MicroViTv2 نموذج محول رؤية (Vision Transformer) خفيف الوزن ومدرك للأجهزة، حيث يستفيد من المكونات المعاد تمثيلها (reparameterized components) وانتباه العمق المنقول الأحادي (Single Depth-Wise Transposed Attention) لتحقيق دقة وكفاءة طاقة فائقتين على أجهزة الحافة، مما يثبت أن التحسين من أجل الأداء في العالم الحقيقي أكثر أهمية من تقليل عمليات النقطة العائمة (FLOPs).