💬 NLP

When Large Language Models are More PersuasiveThan Incentivized Humans, and Why

تُظهر هذه الورقة أن النماذج اللغوية الكبيرة يمكنها التفوق على المُلَقّنين البشريين المحفزين في سياقات صادقة وخادعة على حد سواء، رغم أن هذا التفوق يعتمد على السياق، ويتفاوت باختلاف النموذج، ويتراجع مع التفاعلات المتكررة، ويرجع ذلك على الأرجح إلى تعبير النماذج عن قناعة أعلى.

Philipp Schoenegger, Francesco Salvi, Jiacheng Liu, Xiaoli Nan, Ramit Debnath, Barbara Fasolo, Evelina Leivada, Gabriel (…)2026-03-03
💬 NLP

Dynamic Token Reweighting for Robust Vision-Language Models

تقدم هذه الورقة البحثية DTR، وهو دفاع مبتكر أثناء وقت الاستدلال يعمل على إعادة وزن الرموز البصرية ديناميكيًا من خلال تحسين مخازن المفتاح-القيمة (key-value caches) للتخفيف بفعالية من هجمات الاختراق متعددة الوسائط في النماذج اللغوية البصرية مع الحفاظ على القدرات العامة والكفاءة.

Tanqiu Jiang, Jiacheng Liang, Rongyi Zhu, Jiawei Zhou, Fenglong Ma, Ting Wang2026-03-03
💬 NLP

SQUiD: Synthesizing Relational Databases from Unstructured Text

تقدم الورقة البحثية SQUiD، وهو إطار عمل عصبي رمزي مبتكر يسخر النماذج اللغوية الكبيرة لتوليد مخططات قواعد البيانات العلاقاتية وتعبئة الجداول تلقائياً من النصوص غير المهيكلة، مما يظهر أداءً فائقاً عبر مجموعات بيانات متنوعة مقارنة بالنماذج المرجعية الحالية.

Mushtari Sadia, Zhenning Yang, Yunming Xiao, Ang Chen, Amrita Roy Chowdhury2026-03-03
💬 NLP

VeriTrail: Closed-Domain Hallucination Detection with Traceability

تقدم الورقة البحثية VeriTrail، وهي الطريقة وقاعدة البيانات الأولى المصممة لاكتشاف وتتبع الهلوسات في النطاقات المغلقة في كل من العمليات التوليدية أحادية الخطوة ومتعددة الخطوات، وذلك من خلال تحليل المخرجات الوسيطة لتحديد أصل المحتوى غير الأمين.

Dasha Metropolitansky, Jonathan Larson2026-03-03
💬 NLP

RedTeamCUA: Realistic Adversarial Testing of Computer-Use Agents in Hybrid Web-OS Environments

تقدم الورقة البحثية RedTeamCUA، وهو إطار عمل جديد للاختبار العدائي يتضمن بيئة اختبار (sandbox) هجينة لنظام تشغيل الويب ومرجع قياس RTC-Bench، والذي يكشف أن وكلاء استخدام الكمبيوتر الحاليين لا يزالون عرضة بشدة لهجمات حقن الأوامر غير المباشرة، حيث أظهروا معدلات نجاح كبيرة حتى في النماذج الأكثر تطوراً.

Zeyi Liao, Jaylen Jones, Linxi Jiang, Yuting Ning, Eric Fosler-Lussier, Yu Su, Zhiqiang Lin, Huan Sun2026-03-03
💬 NLP

CityLens: Evaluating Large Vision-Language Models for Urban Socioeconomic Sensing

تقدم هذه الورقة CityLens، وهو معيار شامل يتكون من مجموعة بيانات متعددة الوسائط من 17 مدينة عالمية و11 مهمة تنبؤ لتقييم قدرات وحدود 17 نموذجاً من نماذج الرؤية واللغة الكبيرة المتطورة في التنبؤ بمختلف المؤشرات الاجتماعية والاقتصادية الحضرية من البيانات المرئية.

Tianhui Liu, Hetian Pang, Xin Zhang, Tianjian Ouyang, Zhiyuan Zhang, Jie Feng, Yong Li, Pan Hui2026-03-03
💬 NLP

OmniSpatial: Towards Comprehensive Spatial Reasoning Benchmark for Vision Language Models

تقدم هذه الورقة OmniSpatial، وهو معيار مرجعي شامل قائم على علم النفس المعرفي يضم أكثر من 8.4 ألف عينة مشروحة عبر أربع فئات رئيسية، والذي يكشف عن قصور كبير في قدرات الاستدلال المكاني لنماذج الرؤية واللغة الحالية ويستكشف استراتيجيات مثل PointGraph وSpatialCoT لمعالجتها.

Mengdi Jia, Zekun Qi, Shaochen Zhang, Wenyao Zhang, Xinqiang Yu, Jiawei He, He Wang, Li Yi2026-03-03
💬 NLP

Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering

تقترح الورقة البحثية "تقطير المطالبات التكيفي الميتاوي" (Meta-Adaptive Prompt Distillation)، وهو إطار عمل للتعلم الميتاوي يعمل على تقطير الميزات البصرية ذات الصلة بالمهام إلى مطالبات ناعمة قابلة للتكيف عبر وحدة خريطة الانتباه، مما يتفوق بشكل كبير على التعلم السياقي القياسي والضبط الدقيق كفء المعلمات لمهام الإجابة على الأسئلة البصرية في النماذج متعددة الوسائط الكبيرة ضمن سيناريوهات التعلم من أمثلة قليلة.

Akash Gupta, Amos Storkey, Mirella Lapata2026-03-03
💬 NLP

VINCIE: Unlocking In-context Image Editing from Video

تقدم الورقة البحثية VINCIE، وهو محول انتشار سببي-كتلي (block-causal diffusion transformer) تم تدريبه حصرياً على تسلسلات متعددة الوسائط مستمدة من الفيديو من خلال ثلاث مهام وسيطة، والذي يحقق أداءً هو الأفضل في فئته في تحرير الصور ضمن السياق ويظهر قدرات قوية في تركيب المفاهيم المتعددة وتوليد القصص.

Leigang Qu, Feng Cheng, Ziyan Yang, Qi Zhao, Shanchuan Lin, Yichun Shi, Yicong Li, Wenjie Wang, Tat-Seng Chua, Lu Jiang2026-03-03
💬 NLP

Equitable Electronic Health Record Prediction with FAME: Fairness-Aware Multimodal Embedding

تقدم هذه الورقة FAME، وهو إطار عمل للتمثيل متعدد الوسائط مراعٍ للعدالة، يعمل على تحسين كل من أداء التنبؤ والإنصاف في مهام السجلات الصحية الإلكترونية من خلال وزن الوسائط صراحةً بناءً على مساهماتها في العدالة واستخدام طريقة تجميع غير مقيدة بالإشارة لموازنة نتائج المجموعات الفرعية.

Nikkie Hooman, Zhongjie Wu, Eric C. Larson, Mehak Gupta2026-03-03