💬 NLP

OCR or Not? Rethinking Document Information Extraction in the MLLMs Era with Real-World Large-Scale Datasets

تقدم هذه الورقة دراسة معيارية واسعة النطاق تثبت أن النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) القوية يمكنها تحقيق أداء في استخراج معلومات المستندات يضاهي مسارات العمل التقليدية المعززة بتقنية التعرف الضوئي على الحروف (OCR) باستخدام مدخلات الصور فقط، مع توفير إطار عمل آلي لتحليل الأخطاء وإرشادات عملية لتحسين المخطط والتعليمات.

Jiyuan Shen, Peiyue Yuan, Atin Ghosh, Yifan Mai, Daniel Dahlmeier2026-03-04
💬 NLP

Faster, Cheaper, More Accurate: Specialised Knowledge Tracing Models Outperform LLMs

تُظهر هذه الورقة أن نماذج تتبع المعرفة المتخصصة تتفوق بشكل كبير على النماذج اللغوية الكبيرة في التنبؤ باستجابات الطلاب من خلال تحقيق دقة ودرجات F1 أعلى، مع كونها أسرع بمراتب عديدة وأكثر فعالية من حيث التكلفة عند النشر.

Prarthana Bhattacharyya, Joshua Mitton, Ralph Abboud, Simon Woodhead2026-03-04
💬 NLP

The Distribution of Phoneme Frequencies across the World's Languages: Macroscopic and Microscopic Information-Theoretic Models

تقدم هذه الورقة إطاراً موحداً قائماً على نظرية المعلومات يفسر توزيعات تكرار الفونيمات العالمية من خلال الإحصاءات الرتبية العيانية لتوزيع ديريكليه المتماثل ونماذج الإنتروبيا القصوى المجهرية المقيدة بالعوامل النطقية، والصوتية، والمعجمية.

Fermín Moscoso del Prado Martín, Suchir Salhan2026-03-04
💬 NLP

Nodes Are Early, Edges Are Late: Probing Diagram Representations in Large Vision-Language Models

من خلال سبر أغوار نماذج اللغات الكبيرة متعددة الوسائط (LVLMs) باستخدام مجموعة بيانات رسوم بيانية موجهة اصطناعية، تكشف هذه الدراسة أنه بينما يتم ترميز معلومات العقد والبنية خطياً في مرحلة مبكرة في المشفر البصري، فإن تمثيلات الحواف لا تظهر إلا لاحقاً في الرموز النصية للنموذج اللغوي، مما يفسر معاناة هذه النماذج المستمرة مع الفهم العلاقاتي.

Haruto Yoshida, Keito Kudo, Yoichi Aoki, Ryota Tanaka, Itsumi Saito, Keisuke Sakaguchi, Kentaro Inui2026-03-04
💬 NLP

ACE-Merging: Data-Free Model Merging with Adaptive Covariance Estimation

تقدم هذه الورقة ACE-Merging، وهو إطار عمل لدمج النماذج بدون بيانات يستفيد من رؤية نظرية لتقدير تباين مدخلات المهام ضمنياً من فروق المعلمات، مما يتيح حلاً مغلق الصيغة ومبنياً على أسس سليمة يتفوق بشكل كبير على الأساليب الحالية في التخفيف من التداخل بين المهام عبر معايير الرؤية واللغة.

Bo Xu, Haotian Wu, Hehai Lin, Weiquan Huang, Beier Zhu, Yao Shu, Chengwei Qin2026-03-04
💬 NLP

Contextualized Privacy Defense for LLM Agents

تقترح هذه الورقة "التوجيه الدفاعي السياقي" (CDI)، وهو نموذج دفاعي جديد للخصوصية يستخدم نموذج توجيه مدرب بالتعلم التعزيزي لتوليد إرشادات استباقية مدركة للسياق أثناء تنفيذ وكيل النماذج اللغوية الكبيرة (LLM)، مما يحقق تفوقاً في الحفاظ على الخصوصية والمساعدة مقارنة بالدفاعات الثابتة الأساسية.

Yule Wen, Yanzhe Zhang, Jianxun Lian, Xiaoyuan Yi, Xing Xie, Diyi Yang2026-03-04
💬 NLP

TAO-Attack: Toward Advanced Optimization-Based Jailbreak Attacks for Large Language Models

تقترح هذه الورقة البحثية TAO-Attack، وهي طريقة اختراق جديدة قائمة على التحسين تستخدم دالة خسارة ذات مرحلتين واستراتيجية تحسين للرموز تعطي الأولوية للاتجاه، لتتفوق بشكل كبير على النهج الحالية في تجاوز ضوابط السلامة وتحقيق معدلات نجاح عالية في الهجوم عبر مختلف النماذج اللغوية الكبيرة.

Zhi Xu, Jiaqi Li, Xiaotong Zhang, Hong Yu, Han Liu2026-03-04
💬 NLP

Compact Prompting in Instruction-tuned LLMs for Joint Argumentative Component Detection

تقترح هذه الورقة نهجاً جديداً يعيد صياغة عملية "الكشف عن المكونات الحجاجية" كمهام توليد لغوي باستخدام مطالبات موجزة قائمة على التعليمات لنماذج لغوية كبيرة مضبوطة وفق التعليمات، محققةً أداءً هو الأفضل من نوعه عبر تحديد النطاقات الحجاجية مباشرة من النص العادي دون الاعتماد على مكونات مقسمة مسبقاً.

Sofiane Elguendouze, Erwan Hain, Elena Cabrio, Serena Villata2026-03-04
💬 NLP

BeyondSWE: Can Current Code Agent Survive Beyond Single-Repo Bug Fixing?

تقدم هذه الورقة BeyondSWE، وهو معيار شامل يكشف عن قيود كبيرة في قدرة وكلاء الكود الحاليين على التعامل مع المهام المعقدة والواقعية التي تتجاوز إصلاح الأخطاء في مستودع واحد، وتقترح SearchSWE للتحقيق في الفوائد غير المتسقة لتعزيز البحث في محاكاة سير عمل المطورين.

Guoxin Chen, Fanzhe Meng, Jiale Zhao, Minghao Li, Daixuan Cheng, Huatong Song, Jie Chen, Yuzhi Lin, Hui Chen, Xin Zhao (…)2026-03-04
💬 NLP

ACE-Brain-0: Spatial Intelligence as a Shared Scaffold for Universal Embodiments

تقدم هذه الورقة البحثية ACE-Brain-0، وهو دماغ تأسيسي عام يستفيد من الذكاء المكاني كركيزة عالمية ويوظف نموذج (Scaffold-Specialize-Reconcile - SSR) لتوحيد المهام المتجسدة المتنوعة مثل القيادة الذاتية والروبوتات ضمن نموذج لغوي كبير متعدد الوسائط واحد، محققاً أداءً هو الأفضل في فئته عبر 24 معياراً.

Ziyang Gong, Zehang Luo, Anke Tang, Zhe Liu, Shi Fu, Zhi Hou, Ganlin Yang, Weiyun Wang, Xiaofeng Wang, Jianbo Liu, Gen L (…)2026-03-04