💬 NLP

Learning to Interrupt in Language-based Multi-agent Communication

تقدم هذه الورقة HANDRAISER، وهو إطار عمل قائم على التعلم يُمكّن وكلاء الاستماع من مقاطعة المتحدثين في نقاط مثالية بناءً على المكافآت والتكاليف المقدرة، مما يقلل من عبء الاتصالات بنسبة 32.2% مع الحفاظ على أداء المهام أو تحسينه عبر سيناريوهات متنوعة متعددة الوكلاء.

Danqing Wang, Da Yin, Ruta Desai, Lei Li, Asli Celikyilmaz, Ansong Ni2026-04-09
💬 NLP

Context-Aware Dialectal Arabic Machine Translation with Interactive Region and Register Selection

تقدم هذه الورقة إطار عمل مدركاً للسياق وقابلاً للتوجيه للترجمة الآلية للغة العربية، يستخدم مسار تعزيز بيانات قائماً على القواعد لتوليد مجموعة بيانات لهجات متوازنة، مما يتيح تحكماً في المخرجات عبر ثمانية تنوعات إقليمية وسجلات اجتماعية، مع إثبات أن مقاييس BLEU القياسية قد تفشل في رصد الأصالة الثقافية الفائقة والخصوصية اللهجوية التي تتميز بها هذه النماذج مقارنة بالنماذج المرجعية عالية الموارد.

Afroza Nowshin, Prithweeraj Acharjee Porag, Haziq Jeelani, Fayeq Jeelani Syed2026-04-09
💬 NLP

ValueGround: Evaluating Culture-Conditioned Visual Value Grounding in MLLMs

تقدم هذه الورقة البحثية ValueGround، وهو معيار مرجعي جديد يقيم قدرة النماذج اللغوية الكبيرة متعددة الوسائط على مواءمة الأحكام القيمية المشروطة ثقافياً مع التمثيلات البصرية، مما يكشف عن انخفاض كبير في الأداء عند الانتقال من الخيارات النصية فقط إلى الخيارات المصورة.

Zhipin Wang, Christoph Leiter, Christian Frey, Mohamed Hesham Ibrahim Abdalla, Josif Grabocka, Steffen Eger2026-04-09
💬 NLP

Closing the Speech-Text Gap with Limited Audio for Effective Domain Adaptation in LLM-Based ASR

تُثبت هذه الورقة أن دمج كمية صغيرة من البيانات المقترنة بين الكلام والنص (بنسبة ضئيلة تصل إلى 10% من المجال المستهدف) في استراتيجية التكيف القائمة على الدفعات المختلطة يسد فجوة النمط بفعالية في أنظمة التعرف التلقائي على الكلام القائمة على النماذج اللغوية الكبيرة، محققاً أداءً يضاهي الضبط الدقيق للبيانات الكاملة مع الاستفادة من كفاءة التكيف المعتمد على النصوص فقط.

Thibault Bañeras-Roux, Sergio Burdisso, Esaú Villatoro-Tello, Dairazalia Sánchez-Cortés, Shiran Liu, Severin Baroudi, Sh (…)2026-04-09
💬 NLP

MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts

تقدم الورقة البحثية MedConclusion، وهي مجموعة بيانات ضخمة تضم 5.7 مليون ملخص مهيكل من PubMed، صُممت لاختبار وتطوير قدرة النماذج اللغوية الكبيرة على توليد استنتاجات علمية من الأدلة الطبية الحيوية، مع تسليط الض الضوء على التحديات المتميزة لتوليد الاستنتاجات مقارنة بالتلخيص.

Weiyue Li, Ruizhi Qian, Yi Li, Yongce Li, Yunfan Long, Jiahui Cai, Yan Luo, Mengyu Wang2026-04-09
💬 NLP

Fine-tuning Whisper for Pashto ASR: strategies and scale

تتناول هذه الورقة فشل نماذج "ويسبير" (Whisper) المدربة مسبقاً على لغة البشتو من خلال إثبات أن الضبط الدقيق الكامل التقليدي (vanilla full fine-tuning) على بيانات "كومون فويس" (CommonVoice) للغة البشتو يتفوق بشكل كبير على استراتيجيات التعلم بنقل المعرفة والتعلم كفء المعلمات، مما يحدد نموذج "ويسبير-سمول" (whisper-small) كحجم النموذج الأمثل لـ 113 ساعة المتاحة من بيانات التدريب، مع تحديد أنماط أخطاء صرفية وصوتية محددة.

Hanif Rahman2026-04-09
💬 NLP

The Illusion of Stochasticity in LLMs

تُثبت هذه الورقة أنه بينما يمكن للنماذج اللغوية الكبيرة استخدام البذور العشوائية المقدمة لتوليد توزيعات مستهدفة، إلا أنها تفشل بشكل جوهري في أخذ عينات بشكل موثوق ومباشر من توزيعات محددة بناءً على تقديراتها الاحتمالية الداخلية، مما يمثل قصوراً حرجاً لاستخدامها كأنظمة وكيلة.

Xiangming Gu, Soham De, Michalis Titsias, Larisa Markeeva, Petar Veličković, Razvan Pascanu2026-04-09
💬 NLP

To Lie or Not to Lie? Investigating The Biased Spread of Global Lies by LLMs

تقدم هذه الورقة GlobalLies، وهي مجموعة بيانات متعددة اللغات تكشف أن النماذج اللغوية الكبيرة تولد وتنشر المعلومات المضللة بشكل غير متناسب عن اللغات ذات الموارد المنخفضة والدول ذات درجات مؤشر التنمية البشرية المنخفضة، مع تسليط الضوء على فجوات كبيرة في استراتيجيات التخفيف الحالية عبر مختلف المناطق واللغات.

Zohaib Khan, Mustafa Dogan, Ifeoma Okoh, Pouya Sadeghi, Siddhartha Shrestha, Sergius Justus Nyah, Mahmoud O. Mokhiamar (…)2026-04-09
💬 NLP

The Detection--Extraction Gap: Models Know the Answer Before They Can Say It

تحدد هذه الورقة "فجوة الكشف والاستخراج" في نماذج الاستدلال الحديثة حيث تصبح الإجابة الصحيحة قابلة للاسترداد من الحالة الداخلية قبل وقت طويل من توليدها صراحةً، وتقترح طريقة "الخروج المبكر التكيفي للصندوق الأسود" التي تستفيد من هذا التباين لتقليل تكاليف التوليد بشكل كبير مع تحسين الدقة.

Hanyang Wang, Mingxuan Zhu2026-04-09
💬 NLP

Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection

تقدم الورقة البحثية "Argus"، وهو إطار عمل جديد متعدد الوكلاء يعيد تنظيم سير عمل التحليل الساكن من خلال دمج تحليل سلاسل التوريد، والوكلاء المتعاونين، وتقنيات متقدمة مثل RAG وReAct ليتفوق بشكل كبير على الأساليب الحالية القائمة على النماذج اللغوية الكبيرة في اكتشاف الثغرات الحقيقية مع تقليل الإيجابيات الكاذبة والتكاليف التشغيلية.

Zi Liang, Qipeng Xie, Jun He, Bohuan Xue, Weizheng Wang, Yuandao Cai, Fei Luo, Boxian Zhang, Haibo Hu, Kaishun Wu2026-04-09