💬 NLP

SQUiD: Synthesizing Relational Databases from Unstructured Text

تقدم الورقة البحثية SQUiD، وهو إطار عمل عصبي رمزي مبتكر يسخر النماذج اللغوية الكبيرة لتوليد مخططات قواعد البيانات العلاقاتية وتعبئة الجداول تلقائياً من النصوص غير المهيكلة، مما يظهر أداءً فائقاً عبر مجموعات بيانات متنوعة مقارنة بالنماذج المرجعية الحالية.

Mushtari Sadia, Zhenning Yang, Yunming Xiao, Ang Chen, Amrita Roy Chowdhury2026-03-03
💬 NLP

VeriTrail: Closed-Domain Hallucination Detection with Traceability

تقدم الورقة البحثية VeriTrail، وهي الطريقة وقاعدة البيانات الأولى المصممة لاكتشاف وتتبع الهلوسات في النطاقات المغلقة في كل من العمليات التوليدية أحادية الخطوة ومتعددة الخطوات، وذلك من خلال تحليل المخرجات الوسيطة لتحديد أصل المحتوى غير الأمين.

Dasha Metropolitansky, Jonathan Larson2026-03-03
💬 NLP

RedTeamCUA: Realistic Adversarial Testing of Computer-Use Agents in Hybrid Web-OS Environments

تقدم الورقة البحثية RedTeamCUA، وهو إطار عمل جديد للاختبار العدائي يتضمن بيئة اختبار (sandbox) هجينة لنظام تشغيل الويب ومرجع قياس RTC-Bench، والذي يكشف أن وكلاء استخدام الكمبيوتر الحاليين لا يزالون عرضة بشدة لهجمات حقن الأوامر غير المباشرة، حيث أظهروا معدلات نجاح كبيرة حتى في النماذج الأكثر تطوراً.

Zeyi Liao, Jaylen Jones, Linxi Jiang, Yuting Ning, Eric Fosler-Lussier, Yu Su, Zhiqiang Lin, Huan Sun2026-03-03
💬 NLP

CityLens: Evaluating Large Vision-Language Models for Urban Socioeconomic Sensing

تقدم هذه الورقة CityLens، وهو معيار شامل يتكون من مجموعة بيانات متعددة الوسائط من 17 مدينة عالمية و11 مهمة تنبؤ لتقييم قدرات وحدود 17 نموذجاً من نماذج الرؤية واللغة الكبيرة المتطورة في التنبؤ بمختلف المؤشرات الاجتماعية والاقتصادية الحضرية من البيانات المرئية.

Tianhui Liu, Hetian Pang, Xin Zhang, Tianjian Ouyang, Zhiyuan Zhang, Jie Feng, Yong Li, Pan Hui2026-03-03
💬 NLP

OmniSpatial: Towards Comprehensive Spatial Reasoning Benchmark for Vision Language Models

تقدم هذه الورقة OmniSpatial، وهو معيار مرجعي شامل قائم على علم النفس المعرفي يضم أكثر من 8.4 ألف عينة مشروحة عبر أربع فئات رئيسية، والذي يكشف عن قصور كبير في قدرات الاستدلال المكاني لنماذج الرؤية واللغة الحالية ويستكشف استراتيجيات مثل PointGraph وSpatialCoT لمعالجتها.

Mengdi Jia, Zekun Qi, Shaochen Zhang, Wenyao Zhang, Xinqiang Yu, Jiawei He, He Wang, Li Yi2026-03-03
💬 NLP

Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering

تقترح الورقة البحثية "تقطير المطالبات التكيفي الميتاوي" (Meta-Adaptive Prompt Distillation)، وهو إطار عمل للتعلم الميتاوي يعمل على تقطير الميزات البصرية ذات الصلة بالمهام إلى مطالبات ناعمة قابلة للتكيف عبر وحدة خريطة الانتباه، مما يتفوق بشكل كبير على التعلم السياقي القياسي والضبط الدقيق كفء المعلمات لمهام الإجابة على الأسئلة البصرية في النماذج متعددة الوسائط الكبيرة ضمن سيناريوهات التعلم من أمثلة قليلة.

Akash Gupta, Amos Storkey, Mirella Lapata2026-03-03
💬 NLP

VINCIE: Unlocking In-context Image Editing from Video

تقدم الورقة البحثية VINCIE، وهو محول انتشار سببي-كتلي (block-causal diffusion transformer) تم تدريبه حصرياً على تسلسلات متعددة الوسائط مستمدة من الفيديو من خلال ثلاث مهام وسيطة، والذي يحقق أداءً هو الأفضل في فئته في تحرير الصور ضمن السياق ويظهر قدرات قوية في تركيب المفاهيم المتعددة وتوليد القصص.

Leigang Qu, Feng Cheng, Ziyan Yang, Qi Zhao, Shanchuan Lin, Yichun Shi, Yicong Li, Wenjie Wang, Tat-Seng Chua, Lu Jiang2026-03-03
💬 NLP

Equitable Electronic Health Record Prediction with FAME: Fairness-Aware Multimodal Embedding

تقدم هذه الورقة FAME، وهو إطار عمل للتمثيل متعدد الوسائط مراعٍ للعدالة، يعمل على تحسين كل من أداء التنبؤ والإنصاف في مهام السجلات الصحية الإلكترونية من خلال وزن الوسائط صراحةً بناءً على مساهماتها في العدالة واستخدام طريقة تجميع غير مقيدة بالإشارة لموازنة نتائج المجموعات الفرعية.

Nikkie Hooman, Zhongjie Wu, Eric C. Larson, Mehak Gupta2026-03-03
💬 NLP

When Does Divide and Conquer Work for Long Context LLM? A Noise Decomposition Framework

تقترح هذه الورقة إطاراً لتفكيك الضجيج يصنف إخفاقات النماذج اللغوية الكبيرة ذات السياق الطويل إلى ضجيج المهمة، وضجيج النموذج، وضجيج المجمع، مما يثبت أن استراتيجيات التجزئة متعددة الوكلاء يمكن أن تتفوق على النماذج المتقدمة ذات الدفعة الواحدة من خلال إدارة مصادر الخطأ المحددة هذه بفعالية.

Zhen Xu, Shang Zhu, Jue Wang, Junlin Wang, Ben Athiwaratkun, Chi Wang, James Zou, Ce Zhang2026-03-03
💬 NLP

Cognitive models can reveal interpretable value trade-offs in language models

تُظهر هذه الورقة أن تطبيق النماذج المعرفية لاتخاذ القرار البشري على النماذج اللغوية يكشف عن مقايضات قيمية قابلة للتفسير، مما يبين كيف تشكل جهود الاستدلال، والمطالبات، وديناميكيات ما بعد التدريب سلوك النموذج بشكل منهجي، وتوفر إطاراً مرناً لتشخيص والتحكم في هذه المقايضات أثناء عملية التطوير.

Sonia K. Murthy, Rosie Zhao, Jennifer Hu, Sham Kakade, Markus Wulfmeier, Peng Qian, Tomer Ullman2026-03-03