💬 NLP

Mapping the Course for Prompt-based Structured Prediction

تقترح هذه الورقة دمج النماذج اللغوية الكبيرة مع الاستدلال التوافقي لتحسين التنبؤ المهيكل من خلال تعزيز الاتساق والدقة، حيث أثبتت من خلال تجارب شاملة أن الاستدلال الرمزي يتفوق على مجرد استخدام التلقين وحده، وأن المعايرة الإضافية مع أهداف التعلم المهيكل تحقق أداءً فائقاً في المهام الصعبة.

Matt Pauk, Maria Leonor Pacheco2026-03-27
💬 NLP

Do Language Models Follow Occam's Razor? An Evaluation of Parsimony in Inductive and Abductive Reasoning

تقدم هذه الورقة إطاراً اصطناعياً ومقياساً مؤتمتاً لتقييم ما إذا كانت النماذج اللغوية الكبيرة تلتزم بمبدأ "نصل أوكام" في الاستدلال الاستقرائي والاستنباطي، مما يكشف أنه بينما يمكن للنماذج التعامل مع السيناريوهات البسيطة، فإنها تواجه صعوبة في إنتاج فرضيات صحيحة وموجزة في نماذج العالم المعقدة حتى مع استخدام تقنيات الاستدلال المتقدمة.

Yunxin Sun, Abulhair Saparov2026-03-27
💬 NLP

ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization

تقدم الورقة البحثية ReSum، وهو إطار عمل يعمل دون الحاجة إلى تدريب وقابل للتوصيل والتشغيل المباشر، يُمكّن الوكلاء الويب القائمين على النماذج اللغوية الكبيرة من التغلب على قيود نافذة السياق من خلال التلخيص الدوري للسجل، والذي يتم تعزيزه بشكل أكبر بواسطة ReSum-GRPO لتحسين تخصيص الائتمان طويل الأمد عبر بث الميزة.

Xixi Wu, Kuan Li, Yida Zhao, Liwen Zhang, Litu Ou, Huifeng Yin, Zhongwang Zhang, Xinmiao Yu, Dingchu Zhang, Yong Jiang (…)2026-03-27
💬 NLP

GeoResponder: Towards Building Geospatial LLMs for Time-Critical Disaster Response

تقدم الورقة البحثية GeoResponder، وهو إطار عمل يعزز قدرات النماذج اللغوية الكبيرة في الاستدلال الجغرافي المكاني من خلال منهج تعليمي لضبط التعليمات القائم على السقالات، مما يمكنها من دعم مهام الاستجابة للكوارث الحرجة زمنياً بفعالية من خلال التنقل بدقة في شبكات الطرق وتحديد مواقع البنية التحتية الأساسية.

Ahmed El Fekih Zguir, Ferda Ofli, Muhammad Imran2026-03-27
💬 NLP

DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models

تقدم هذه الورقة البحثية DiffuGuard، وهو إطار دفاعي لا يتطلب تدريباً يعمل على التخفيف من نقاط الضعف الفريدة لعمليات كسر الحماية في نماذج الانتشار اللغوية الكبيرة (Diffusion LLMs) عبر معالجة انحيازات إعادة القناع الجشعة الضارة والاعتماد على مسار إزالة الضجيج من خلال التلدين العشوائي وآليات التدقيق على مستوى الكتل، مما يقلل بشكل كبير من معدلات نجاح الهجمات مع الحفاظ على فائدة النموذج.

Zherui Li, Zheng Nie, Zhenhong Zhou, Yue Liu, Yitong Zhang, Yu Cheng, Qingsong Wen, Kun Wang, Yufei Guo, Jiaheng Zhang2026-03-27
💬 NLP

CQA-Eval: Designing Reliable Evaluations of Multi-paragraph Clinical QA under Resource Constraints

تقدم هذه الورقة البحثية CQA-Eval، وهو إطار عمل ومجموعة من التوصيات لتقييم أنظمة الأسئلة والأجوبة السريرية متعددة الفقرات بكفاءة في ظل قيود الموارد، حيث تُثبت من خلال تعليقات الأطباء أن التحليل الدقيق على مستوى الجمل يحسن الاتفاق في الصحة بينما يلتقط التحليل العام مستوى الصلة بشكل أفضل، وأن تعليق مجموعة فرعية صغيرة من الجمل يمكن أن يحقق موثوقية مماثلة للتعليقات العامة الكاملة.

Federica Bologna, Tiffany Pan, Matthew Wilkens, Yue Guo, Lucy Lu Wang2026-03-27
💬 NLP

FactAppeal: Identifying Epistemic Factual Appeals in News Media

تقدم هذه الورقة FactAppeal، وهي مجموعة بيانات مُعنونة يدويًا تضم 3,226 جملة إخبارية صُممت لتطوير المهمة المستحدثة المتمثلة في تحديد الاستمالة المعرفية عبر رصد البنى الاستدلالية الدقيقة وخصائص المصادر، إلى جانب تقييم النماذج الترميزية والتوليدية التي حققت درجة F1 كليّة بلغت 0.73.

Guy Mor-Lan, Tamir Sheafer, Shaul R. Shenhav2026-03-27
💬 NLP

CNSocialDepress: A Chinese Social Media Dataset for Depression Risk Detection and Structured Analysis

تقدم هذه الورقة البحثية CNSocialDepress، وهي مجموعة بيانات شاملة لوسائل التواصل الاجتماعي الصينية تضم 44,178 منشوراً وسمات نفسية مشروحة من قبل خبراء تتيح الكشف عن مخاطر الاكتئاب بدقة وتفسير عالٍ، وتحليلاً مهيكلاً يتجاوز التصنيف الثنائي التقليدي.

Jinyuan Xu, Tian Lan, Xintao Yu, Xue He, Hezhi Zhang, Ying Wang, Pierre Magistry, Mathieu Valette, Lei Li2026-03-27
💬 NLP

See the Text: From Tokenization to Visual Reading

تقدم الورقة البحثية SeeTok، وهو نهج متمحور حول الرؤية يقوم بتصوير النصوص كصور لتقوم النماذج اللغوية الكبيرة متعددة الوسائط بتفسيرها، مما يستبدل بفعالية عملية تقسيم الكلمات إلى وحدات فرعية (subword tokenization) لتحقيق كفاءة حوسبية كبيرة، وتحسين المتانة تجاه الضجيج الطباعي، وتحقيق تعميم أفضل عبر اللغات من خلال محاكاة القراءة البصرية البشرية.

Ling Xing, Rui Yan, Alex Jinpeng Wang, Zechao Li, Jinhui Tang2026-03-27
💬 NLP

Which Way Does Time Flow? A Psychophysics-Grounded Evaluation for Vision-Language Models

تقدم هذه الورقة AoT-PsyPhyBENCH، وهو معيار تم التحقق من صحته نفسيًا وجسديًا يوضح أن نماذج الرؤية واللغة الحالية تعاني في تحديد سهم الزمن في الفيديوهات الطبيعية، مما يكشف عن فجوة جوهرية في قدراتها على الاستدلال الزمني والسببي مقارنة بالبشر.

Shiho Matta, Lis Kanashiro Pereira, Peitao Han, Fei Cheng, Shigeru Kitazawa2026-03-27