💬 NLP

Benchmarking Retrieval Strategies for Biomedical Retrieval-Augmented Generation: A Controlled Empirical Study

تقدم هذه الورقة دراسة تجريبية منضبطة تقارن بين خمس استراتيجيات استرجاع في مسار توليد معزز بالاسترجاع (RAG) للمجال الطبي الحيوي، حيث وجدت أن إعادة الترتيب باستخدام المشفر المتقاطع (Cross-Encoder Reranking) تحقق أعلى أداء، بينما تفوقت جميع طرق الاسترجاع بشكل كبير على التوليد بدون سياق.

Devi Prasad Bal, Subhashree Puhan2026-05-06
💬 NLP

Dependency Parsing Across the Resource Spectrum: Evaluating Architectures on High and Low-Resource Languages

تقيم هذه الدراسة بنيات الإعراب التبعي عبر عشر لغات متنوعة نمطياً، وتجد أنه بينما تتفوق نماذج المحولات (Transformer) في حالة وفرة البيانات، فإن نموذج (Biaffine LSTM) الأبسط يتفوق باستمرار في ظل ظروف الموارد المنخفضة، لا سيما بالنسبة للغات الأفريقية المعقدة صرفياً، وذلك حتى يتوفر قدر كافٍ من البيانات المشروحة.

Kevin Guan, Happy Buzaaba, Christiane Fellbaum2026-05-06
💬 NLP

Beating the Style Detector: Three Hours of Agentic Research on the AI-Text Arms Race

باستخدام نظام بحث وكيل (agentic research harness) لإعادة إنتاج وتوسيع دراسة من مؤتمر ACL 2026، تُثبت هذه الورقة أن النماذج اللغوية الكبيرة الرائدة مثل GPT-5.5 وClaude Opus 4.7 لا يمكنها فقط تجاوز التحرير البشري اللاحق في محاكة أساليب الكتابة الشخصية، بل يمكنها أيضًا التهرب بفعالية من كواشف النصوص الاصطناعية من خلال التغذية الراجعة التنافسية المتكررة، مما يثير مخاوف كبيرة بشأن مستقبل سباقات التسلح في مجال الكشف عن الذكاء الاصطناعي.

Andreas Maier, Moritz Zaiss, Siming Bayer2026-05-06
💬 NLP

Synthetic Users, Real Differences: an Evaluation Framework for User Simulation in Multi-Turn Conversations

تقدم هذه الورقة "realsim"، وهو إطار تقييم توزيعي لتقدير واقعية محاكاة المستخدم عبر ثمانية أبعاد باستخدام مجموعة بيانات منسقة تضم 1,000 حوار متعدد الأدوار، كاشفةً أن المستخدمين المحاكيين الحاليين غالباً ما يخفقون في استيعاب احتكاكات التواصل في العالم الحقيقي ويظهرون تباينًا كبيرًا في الأداء عبر مجالات التطبيق المختلفة.

Yu Lu Liu, Hyokun Yun, Tanya Roosta, Ziang Xiao2026-05-06
💬 NLP

ContextualJailbreak: Evolutionary Red-Teaming via Simulated Conversational Priming

تقدم الورقة البحثية ContextualJailbreak، وهو إطار عمل تطوري لاختبار الاختراق (red-teaming) يستخدم عوامل طفرة مبتكرة وتصنيفًا متدرجًا للضرر لتحسين التمهيد الحواري متعدد الأدوار، محققًا معدلات نجاح شبه مثالية في كسر الحماية على نماذج مفتوحة متنوعة، ومظهرًا قابلية نقل كبيرة إلى النماذج المغلقة الرائدة مع الكشف عن تباينات صارخة في متانة المحاذاة عبر مختلف المزودين.

Mario Rodríguez Béjar, Francisco J. Cortés-Delgado, S. Braghin, Jose L. Hernández-Ramos2026-05-06
🤖 AI

The 2026 ACII Dyadic Conversations (DaiKon) Workshop & Challenge

تقدم ورشة عمل وتحدي "محادثات الدايك" (DaiKon) لعام 2026 ضمن مؤتمر ACII معياراً ومجموعة بيانات شاملة تضم 945 تفاعلاً ثنائياً طبيعياً ومتعدد اللغات، وذلك بهدف تطوير نمذجة التأثير المتبادل بين الأشخاص والديناميكيات الاجتماعية من خلال ثلاثة تحديات فرعية تركز على التأثير الاتجاهي، وتبادل الأدوار، والتنبؤ بمسار الألفة.

Panagiotis Tzirakis, Alice Baird, Jeffrey Brooks, Emilia Parada-Cabaleiro, Lukas Stappen, Sharath Rao, Theo Lebryk, Jaku (…)2026-05-06
💬 NLP

mdok-style at SemEval-2026 Task 9: Finetuning LLMs for Multilingual Polarization Detection

تقدم الورقة البحثية نهج أسلوب mdok لمهمة SemEval-2026 Task 9، والذي يحقق كشفاً قوياً للاستقطاب متعدد اللغات عبر ضبط النماذج اللغوية الكبيرة متوسطة الحجم باستخدام تقنية QLoRA على بيانات تدريب معززة بنصوص مجهولة المصدر ومتنوعة الحالات عبر 22 لغة.

Dominik Macko, Alok Debnath, Jakub Simko2026-05-06
🤖 AI

When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition

تقدم هذه الورقة معياراً يوضح أن النماذج الصوتية اللغوية الحالية تفشل في الاستفടക من السياق السريري للتعرف على الكلام المصاب بعسر التلفظ عبر التلقين، ولكنها تُظهر أن الضبط الدقيق القائم على تقنية LoRA باستخدام تلميحات سريرية مختلطة يقلل بشكل كبير من معدلات خطأ الكلمات، لا سيما للمتحدثين المصابين بمتلازمة داون وعسر التلفظ طفيف الشدة.

Pehuén Moure, Niclas Pokel, Bilal Bounajma, Yingqiang Gao, Roman Boehringer, Longbiao Cheng, Shih-Chii Liu2026-05-06
💬 NLP

FunFuzz: An LLM-Powered Evolutionary Fuzzing Framework

يُعد FunFuzz إطار عمل للتفتيش التطوري متعدد الجزر يستفيد من النماذج اللغوية الكبيرة مع مطالبات تكيفية موجهة بالتغذية الراجعة وهجرة دورية للمرشحين للتغلب على حساسية المطالبات وتباين أخذ العينات، مما يحقق تغطية فائقة للمترجمات ويكتشف مدخلات فريدة أكثر تسبب الفشل مقارنة بالنهج السابقة القائمة على النماذج اللغوية الكبيرة.

Mario Rodríguez Béjar, B. Romera-Paredes, Jose L. Hernández-Ramos2026-05-06