Towards Efficient Multimodal and Multilingual Opinion Extraction for STI: A QLoRA-Based Fine-Tuning Approach
تقترح هذه الورقة إطار عمل للضبط الدقيق يعتمد على تقنية QLoRA باستخدام نموذج VideoLLaMA2.1 لتعزيز استخراج الآراء متعدد الوسائط ومتعدد اللغات لاستخبارات العلوم والتكنولوجيا، محققةً مكاسب أداء كبيرة مقارنة بنماذج القياس المرجعي للتعلم الصفري، مع دمج وحدة نظر التوقع الضبابي لتقييم القيمة في المهام اللاحقة.