Feature Evolution and Migration during Vision Transformer Training
تقدم هذه الورقة إطار عمل مبتكرًا يستخدم المشفرات التلقائية المتفرقة (Sparse Autoencoders) لتصور تطور الميزات عبر عمق الشبكة ووقت التدريب في نماذج المحولات الرؤية (Vision Transformers)، مما يكشف أن هجرة الميزات تتركز في مراحل مبكرة من التدريب، وتفضل الانتقال نحو الطبقات الأقل عمقًا، وأن الطبقات الأكثر عمقًا تستقر في وقت أبكر من الطبقات الأقل عمقًا.