VLMaxxing through FrameMogging Training-Free Anti-Recomputation for Video Vision-Language Models
تقدم هذه الورقة إطار عمل لمكافحة إعادة الحساب بدون تدريب لنماذج الرؤية واللغة للفيديو، والذي يعيد استخدام الحالات البصرية المخزنة ديناميكياً للمشاهد والاستعلامات المستقرة، مما يقلل بشكل كبير من زمن انتقال الاستدلال والهدر الحسابي مع الحفاظ على دقة عالية عبر التفاعلات الفيديوية متعددة الأدوار.