Revealing the Truth with ConLLM for Detecting Multi-Modal Deepfakes
यह शोध पत्र ConLLM प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो मोडैलिटी विखंडन (modality fragmentation) और उथले अंतर-मोडल तर्क (shallow inter-modal reasoning) को दूर करने के लिए प्री-ट्रेन्ड मॉडल एम्बेडिंग्स को कंट्रास्टिव लर्निंग और लार्ज लैंग्वेज मॉडल रीजनिंग के साथ जोड़ता है, जिससे ऑडियो, वीडियो और ऑडियो-विजुअल डीपफेक में डिटेक्शन सटीकता में महत्वपूर्ण सुधार होता है।