💬 NLP

LEAF-SQL: Level-wise Exploration with Adaptive Fine-graining for Text-to-SQL Skeleton Prediction

يُعد LEAF-SQL إطار عمل مبتكر يعزز أداء تحويل النص إلى SQL في الاستعلامات المعقدة عبر إعادة صياغة التنبؤ بالهيكل العظمي كعملية بحث في شجرة من الخشن إلى الناعم، مستخدماً تسلسلاً هرمياً ثلاثي المستويات ووكلاء متخصصين لاستكشاف وتكييف الفرضيات الهيكلية المتنوعة بشكل منهجي، مما يحقق دقة تنفيذ رائدة على مقياس BIRD.

Zhao Tan, Xiping Liu, Qing Shu, Qizhi Wan, Dexi Liu, Changxuan Wan2026-05-12
🤖 AI

Do Self-Evolving Agents Forget? Capability Degradation and Preservation in Lifelong LLM Agent Adaptation

تحدد هذه الورقة ظاهرة "تآكل القدرة" في وكلاء النماذج اللغوية الكبيرة ذاتية التطور، حيث يؤدي التكيف مع مهام جديدة إلى تدهور المهارات المتعلمة سابقاً عبر أبعاد سير العمل، والمهارة، والنموذج، والذاكرة، وتقترح إطار عمل "التطور الحافظ للقدرة" (CPE) لتحقيق استقرار التكيف طويل الأمد من خلال منع هذا الانحراف التدميري بشكل صريح.

Ye Yu, Xiaopeng Yuan, Haibo Jin, Heming Liu, Yaoning Yu, Haohan Wang2026-05-12
🤖 machine learning

Mem-W: Latent Memory-Native GUI Agents

يقدم Mem-W فئة جديدة من وكلاء واجهة المستخدم الرسومية (GUI) التي تدمج الذاكرة التاريخية والذاكرة العاملة مباشرة في السياق الكامن للنموذج كرموز مدمجة، مما يلغي التباين بين الذاكرة الرمزية الخارجية والتمثيلات الداخلية لتحسين أداء المهام طويلة المدى بشكل كبير عبر اختبارات الويب والهاتف المحمول.

Guibin Zhang, Yaohui Ling, Fanci Meng, Kun Wang, Shuicheng Yan2026-05-12
🤖 machine learning

Test-Time Speculation

تقدم هذه الورقة البحثية "التخمين وقت الاختبار" (TTS)، وهي طريقة تقطير عبر الإنترنت تعمل على تكييف نموذج مسودة باستمرار أثناء الاستدلال باستخدام إشارات التحقق من النموذج المستهدف، مما يتغلب على تدهور الأداء للنماذج المخمنة الحالية في التسلسلات الطويلة ويحسن أطوال القبول بشكل كبير.

Avinash Kumar, Sujay Sanghavi, Poulami Das2026-05-12✓ Author reviewed
🤖 AI

HOME-KGQA: A Benchmark Dataset for Multimodal Knowledge Graph Question Answering on Household Daily Activities

تقدم هذه الورقة HOME-KGQA، وهو مجموعة بيانات مرجعية جديدة متعددة الوسائط للإجابة على الأسئلة القائمة على الرسوم البيانية للمعرفة والمتمحورة حول الأنشطة المنزلية اليومية، والتي تكشف عن فجوات أداء كبيرة في الأساليب الحالية القائمة على النماذج اللغوية الكبيرة عند التعامل مع الاستدلال المكاني الزماني المعقد والربط متعدد الوسائط المطلوب لتططبيقات الذكاء الاصطناعي المتجسد في العالم الحقيقي.

Shusaku Egami, Aoi Ohta, Tomoki Tsujimura, Masaki Asada, Tatsuya Ishigaki, Ken Fukuda, Masahiro Hamasaki, Hiroya Takamur (…)2026-05-12
🤖 AI

Position: Avoid Overstretching LLMs for every Enterprise Task

تجادل هذه الورقة بأن على المؤسسات تجنب الاعتماد المفرط على النماذج اللغوية الكبيرة في جميع المهام، داعيةً بدلاً من ذلك إلى بنيات معيارية تعمل فيها النماذج اللغوية الكبيرة حصرياً كواجهات للاستخراج المنظم، بينما تتولى قواعد المعرفة المخصصة والإجراءات الرمزية عمليات الحوسبة والتخزين لضمان الموثوقية والقابلية للتوسع والشفافية.

Kuldeep Singh, Anson Bastos, Isaiah Onando Mulang'2026-05-12
🤖 AI

Align and Shine: Building High-Quality Sentence-Aligned Corpora for Multilingual Text Simplification

تقدم هذه الورقة منهجية لبناء متن لغوي متعدد اللغات، متاح للعموم، وعالي الجودة، ومحاذٍ على مستوى الجمل لتبسيط النصوص عبر اللغات الكتالونية والإنجليزية والفرنسية والإيطالية والإسبانية، وذلك من خلال معالجة بيانات قابلة للمقارنة تم جمعها عبر التعهيد الجماعي وتطبيق آليات محاذاة على مستوى الجمل.

Kenji Hilasaca, Nouran Khallaf, Serge Sharoff2026-05-12
🤖 AI

A Cognitively Grounded Bayesian Framework for Misinformation Susceptibility

تقدم هذه الورقة "المستمع البراغماتي المحدود" (BPL)، وهو إطار عمل بايزي (Bayesian) قائم على أسس معرفية يوسع نظرية "أفعال الكلام العقلانية" عبر ثلاثة قيود من العقلانية المحدودة لنمذجة القابلية للتأثر بالمعلومات المضللة، مما يظهر أداءً تنافسيًا في معايير تصنيف الحقيقة ويقدم دعمًا تجريبيًا لمفارقة عدم تطابق العمق.

Pranava Madhyastha2026-05-12
🤖 machine learning

Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning

تقدم هذه الورقة تسلسلاً هرمياً للذاكرة مدركاً للدلالات يقوم بتفريغ رموز الاستدلال منخفضة الأهمية إلى ذاكرة وحدة المعالجة المركزية (CPU) مع خطأ تقريبي صفري، مما يثبت أن دقة الاستدلال تعتمد فقط على نسبة الإخلاء الدائم بدلاً من إشغال الذاكرة ذات النطاق الترددي العالي (HBM)، مما يتيح وفراً كبيراً في الذاكرة مع حد أدنى من تدهور الأداء.

Aojie Yuan, Tianqi Shen, Dajun Zhang2026-05-12
🤖 machine learning

Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models

تقدم هذه الورقة معيار "TriForm" وتقدم أدلة متقاربة على وجود فضاء استدلالي مستقل عن التنسيق (FARS) داخل النماذج اللغوية الكبيرة، مما يثبت أن تمثيلاً داخلياً مدمجاً مكوناً من 10 أبعاد يستوعب مفاهيم الاستدلال المجرد عبر أشكال سطحية متنوعة (النثر، والبرمجة، والرياضيات) مع الكشف عن عدم تماثل جوهري حيث تكون التنسيقات التقريرية أكثر توافقاً مع بعضها البعض مقارنة بالتنسيقات الإجرائية البرمجية.

Aojie Yuan, Zhiyuan Su2026-05-12