💬 NLP

Context Training with Active Information Seeking

تقترح هذه الورقة إطار عمل لتدريب السياق بكفاءة في استخدام البيانات، يجمع بين البحث النشط عن المعلومات عبر أدوات البحث مع إجراء تقليم قائم على البحث لتعزيز أداء النماذج اللغوية الكبيرة بشكل كبير عبر مجالات متنوعة، متجاوزاً بذلك قيود التكامل الساذج للأدوات وتحسين السياق ذي الحلقة المغلقة.

Zeyu Huang, Adhiguna Kuncoro, Qixuan Feng, Jiajun Shen, Lucio Dery, Arthur Szlam, Marc'Aurelio Ranzato2026-05-14
💬 NLP

Scaling few-shot spoken word classification with generative meta-continual learning

تُثبت هذه الورقة أن خوارزمية التعلم المستمر التوليدي (GeMCL) تُمكّن مصنف الكلمات المنطوقة من تعلم 1,000 فئة بالتتابع بخمسة أمثلة فقط لكل منها، محققةً أداءً يضاهي النماذج المرجعية الضبطت بالكامل أو المجمدة، مع التكيف بسرعة أكبر بـ 2,000 مرة وببيانات ووقت تدريب أقل بكثير.

Louise Beyers, Batsirayi Mupamhi Ziki, Ruan van der Merwe2026-05-14
💬 NLP

Does language matter for spoken word classification? A multilingual generative meta-learning approach

تُظهر هذه الورقة أن تطبيق التعلم الميتا-مستمر التوليدي على تصنيف الكلمات المنطوقة متعدد اللغات يكشف أن إجمالي ساعات بيانات التدريب الفريدة تعد مؤشراً أقوى على الأداء من عدد اللغات المدرجة، مع إظهار النماذج متعددة اللغات لنتائج أفضل بقليل فقط من نظيراتها أحادية اللغة.

Batsirayi Mupamhi Ziki, Louise Beyers, Ruan van der Merwe2026-05-14
💬 NLP

GeoBuildBench: A Benchmark for Interactive and Executable Geometry Construction from Natural Language

تقدم هذه الورقة GeoBuildBench، وهو معيار جديد يضم 489 مسألة هندسية باللغة الصينية يقيم قدرة الوكلاء متعددي الوسائط على توليد برامج لغة متخصصة قابلة للتنفيذ لبناء الرسوم التخطيطية الهندسية من اللغة الطبيعية، مما يكشف عن تحديات كبيرة في الدقة الهيكلية والامتثال للقيود رغم الأداء الأولي المعقول.

Jinwoong Kim, Rui Yang, Huishuai Zhang2026-05-14
📊 statistics

LLMs as Implicit Imputers: Uncertainty Should Scale with Missing Information

تجادل هذه الورقة بأن نماذج اللغات الكبيرة التي تعمل كمُستكملات ضمنية يجب أن تُظهر تدرجاً في عدم اليقين مع نقص المعلومات، حيث وجدت أن الثقة القائمة على أخذ العينات تفشل في عكس تدهور السياق المتزايد، بينما يتتبع اعتلاج الاستجابة (response entropy) نقص البيانات بفعالية ويتنبأ بالدقة بشكل أفضل.

Stef van Buuren2026-05-14
💬 NLP

GAGPO: Generalized Advantage Grouped Policy Optimization

تقترح الورقة البحثية "تحسين السياسة المجمعة للميزة المعممة" (GAGPO)، وهي طريقة للتعلم التعزيزي خالية من الناقد، تتيح تخصيص الائتمان الزمني بدقة ومحاذاة الخطوات في وكلاء النماذج اللغوية متعددة الجولات، وذلك عبر بناء بدائل قيم مجمعة غير معلمية من عينات المسارات، مما يؤدي إلى التفوق على النماذج المرجعية الحالية في بيئات مثل ALFWorld وWebShop.

Siyuan Zhu, Chao Yu, Rongxin Yang, Zongkai Liu, Jinjun Hu, Qiwen Chen, Yibo Zhang2026-05-14
💬 NLP

Utility-Oriented Visual Evidence Selection for Multimodal Retrieval-Augmented Generation

تقترح هذه الورقة إطار عمل معلوماتي نظري لا يتطلب تدريباً لعملية التوليد المعزز بالاسترجاع متعدد الوسائط، حيث يختار الأدلة المرئية بناءً على فائدتها (كسب المعلومات) بدلاً من التشابه الدلالي، محققاً أداءً استدلالياً متفوقاً وكفاءة حوسبية عالية عبر معايير قياسية متعددة.

Weiqing Luo, Zongye Hu, Xiao Wang, Zhiyuan Yu, Haofeng Zhang, Ziyi Huang2026-05-14
💬 NLP

CANTANTE: Optimizing Agentic Systems via Contrastive Credit Attribution

يُعد CANTANTE إطار عمل مبتكرًا يعمل على تحسين الأنظمة متعددة الوكلاء القائمة على النماذج اللغوية الكبيرة من خلال حل مشكلة تخصيص الائتمان عبر العزو التبايني للمكافآت على مستوى النظام إلى الوكلاء الأفراد، محققًا أداءً رائدًا في تحسين الأوامر البرمجية عبر معايير متنوعة مع تقليل تكاليف الاستدلال.

Tom Zehle2026-05-14
💬 NLP

What Limits Vision-and-Language Navigation ?

تقدم الورقة البحثية StereoNav، وهو إطار عمل قوي للرؤية واللغة والعمل يستفيد من الرؤية المجسمة وأولويات الموقع المستهدف للتغلب على الفجوات بين المحاكاة والعالم الحقيقي في مجال الملاحة القائمة على الرؤية واللغة، محققاً أداءً هو الأفضل في فئته مع تحسين الموثوقية في البيئات المعقدة، وذلك باستخدام عدد أقل من المعلمات وبيانات تدريب أقل مقارنة بالنهج القائمة على التوسع.

Yunheng Wang, Yuetong Fang, Taowen Wang, Lusong Li, Kun Liu, Junzhe Xu, Zizhao Yuan, Yixiao Feng, Jiaxi Zhang, Wei Lu, Z (…)2026-05-14
💬 NLP

FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages

تقدم هذه الورقة FinVQA، وهو معيار شامل متعدد اللغات للاستدلال المالي عبر ست لغات هندية، وتقترح FIND، وهو إطار عمل يجمع بين الضبط الدقيق الخاضع للإشراف وفك التشفير المدرك للقيود لتعزيز الاستدلال متعدد الوسائط والعددي في السياقات المالية عالية المخاطر.

Sarmistha Das, Vaibhav Vishal, Syed Ibrahim Ahmad, Manish Gupta, Sriparna Saha2026-05-14