CLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge Acquisition
تقدم هذه الورقة CLBench-V، وهو معيار شامل مصمم لتقييم تعلم السياق متعدد الوسائط عبر ثلاثة أبعاد رئيسية —التجذر، وتطبيق المعلومات الجديدة، واكتساب المعرفة— كاشفةً أن النماذج الحالية الرائدة لا تزال تعاني بشكل كبير في هذه المهام رغم التقدم في القدرات متعددة الوسائط.