Video Reasoning without Training
यह शोध पत्र V-Reason को प्रस्तुत करता है, जो एक इन्फरेंस-टाइम अनुकूलन विधि है जो एडेप्टिव माइक्रो-एक्सप्लोरेशन और माइक्रो-एक्सप्लोइटेशन चक्रों के माध्यम से लार्ज मल्टीमॉडल मॉडल्स को निर्देशित करने के लिए एंट्रॉपी-आधारित संकेतों का लाभ उठाती है, जिससे बिना किसी महंगी ट्रेनिंग के अत्याधुनिक वीडियो रीजनिंग प्रदर्शन प्राप्त होता है और टोकन के उपयोग में भी उल्लेखनीय कमी आती है।