Semantic-Aware Adaptive Visual Memory for Streaming Video Understanding
يُعد SAVEMem إطار عمل ثنائي المرحلة وخالٍ من التدريب، يعمل على تعزيز فهم الفيديو المتدفق عبر الإنترنت من خلال دمج البروز الدلالي في توليد الذاكرة واستخدام الاسترجاع المتكيف مع الاستعلام، مما يحسن الأداء بشكل كبير في اختبارات مثل OVO-Bench مع تقليل ذروة استخدام ذاكرة وحدة معالجة الرسومات.