Semantic-Aware Adaptive Visual Memory for Streaming Video Understanding
SAVEMem एक प्रशिक्षण-मुक्त (training-free), द्वि-चरणीय ढांचा है जो मेमोरी जनरेशन में सिमेंटिक सैलिएंस (semantic salience) को एकीकृत करके और क्वेरी-अनुकूलित रिट्रीवल (query-adaptive retrieval) का उपयोग करके ऑनलाइन स्ट्रीमिंग वीडियो समझ को बढ़ाता है, जिससे OVO-Bench जैसे बेंचमार्क पर प्रदर्शन में उल्लेखनीय सुधार होता है और पीक GPU मेमोरी उपयोग कम होता है।