From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
تقترح هذه الورقة إطار عمل جديد لتعمية الفيديو زمانياً ومكانياً قائماً على الانتباه، يستخدم رموز تصنيف مزدوجة في محولات الرؤية (Vision Transformers) لتقليم الأجزاء الأنبوبية (tubelets) الحساسة للخصوصية بشكل انتقائي مع الحفاظ على فائدة التعرف على الأفعال.