Enhancing Sketch Animation: Text-to-Video Diffusion Models with Temporal Consistency and Rigidity Constraints
تقترح هذه الورقة طريقة مبتكرة لتحويل النص إلى رسوم متحركة تخطيطية (sketch-animation) تستفيد من نموذج انتشار (diffusion model) مدرب مسبقاً لتحويل النص إلى فيديو بتوجيه من فقدان SDS، مع إدخال تنظيم الطول والمساحة (length-area regularization) لضمان الاتساق الزمني، وفقدان "الأكثر صلابة بقدر الإمكان" (As-Rigid-As-Possible loss) للحفاظ على طوبولوجيا الرسم التخطيطي، مما يؤدي إلى تفوقها على الأساليب الرائدة حالياً في كل من التقييمات الكمية والنوعية.