💬 NLP

Are Non-English Papers Reviewed Fairly? Language-of-Study Bias in NLP Peer Reviews

تقدم هذه الورقة مجموعة بيانات LOBSTER وطريقة كشف لتوصيف انحياز لغة الدراسة في مراجعات الأقران في مجال معالجة اللغات الطبيعية بشكل منهجي، مما يكشف أن الأوراق غير الإنجليزية تواجه معدلات أعلى بكثير من الانحياز السلبي — لا سيما المطالبات بالتعميم عبر اللغات دون مبرر — مقارنة بالأوراق المكتوبة بالإنجليزية فقط.

Ehsan Barkhordar, Abdulfattah Safa, Verena Blaschke, Erika Lombart, Marie-Catherine de Marneffe, Gözde Gül Şahin2026-04-09
💬 NLP

Language Bias under Conflicting Information in Multilingual LLMs

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة متعددة اللغات تظهر باستمرار تحيزات لغوية عند حل المعلومات المتضاربة، حيث تتجاهل التضارب عادةً لتأكيد إجابة واحدة مع تفضيل اللغة الصينية بشكل منهجي وعدم تفضيل اللغة الروسية عبر مختلف أحجام النماذج وأصول تدريبها.

Robert Östling, Murathan Kurfalı2026-04-09
💬 NLP

Dynamic Context Evolution for Scalable Synthetic Data Generation

تقدم هذه الورقة البحثية "تطور السياق الديناميكي" (DCE)، وهو إطار عمل مبني على أسس منهجية يجمع بين أخذ عينات الذيل اللفظي، والذاكرة الدلالية، والتطور التكيفي للمطالبات، للقضاء بفعالية على انهيار النمط عبر الدفعات وضمان توليد بيانات اصطناعية متنوعة وغنية هيكلياً عبر مجالات وعائلات نماذج متعددة دون الحاجة إلى الضبط الدقيق.

Ryan Lingo, Rajeev Chhajer2026-04-09
💬 NLP

Agent-Driven Corpus Linguistics: A Framework for Autonomous Linguistic Discovery

تقدم هذه الورقة "اللسانيات المتنية المدفوعة بالوكيل"، وهي إطار عمل يقوم فيه نموذج لغوي كبير بإجراء الدورة الكاملة للاستقصاء اللغوي بشكل مستقل عبر توليد الفرضيات والاستعلام عن المتون من خلال واجهة مهيكلة، مما ينتج نتائج قائمة على أسس تجريبية وقابلة للتفنيد بسرعة الآلة مع خفض الحواجز التقنية أمام الباحثين.

Jia Yu, Weiwei Yu, Pengfei Xiao, Fukun Xing2026-04-09
💬 NLP

How Much LLM Does a Self-Revising Agent Actually Need?

تقدم هذه الورقة بروتوكول تشغيل تصريحي يعمل على إخراج حالة الوكيل والتفكير إلى الخارج لإثبات أن التخطيط الصريح لنموذج العالم يعزز الأداء بشكل كبير في الألعاب التعاونية، بينما تقدم المراجعات القائمة على النماذج اللغوية الكبيرة المتفرقة مكاسب هامشية ضئيلة، مما ينقل التركيز من ادعاءات لوحة الصدارة إلى القيمة المنهجية لهياكل الوكيل القابلة للفحص.

Seongwoo Jeong, Seonil Son2026-04-09
🤖 machine learning

On the Price of Privacy for Language Identification and Generation

تثبت هذه الورقة أن تكلفة الخصوصية في تحديد الهوية اللغوية وتوليدها طفيفة بشكل مفاجئ، حيث لا تترتب على الخصوصية التفاضلية التقريبية أي عقوبة في الخطأ، بينما تؤدي الخصوصية التفاضلية النقية فقط إلى خفض الأداء بمعامل ضربي قدره min{1,ε}\min\{1, \varepsilon\} في أس الخطأ.

Xiaoyu Li, Andi Han, Jiaojiao Jiang, Junbin Gao2026-04-09
💬 NLP

Joint Optimization of Reasoning and Dual-Memory for Self-Learning Diagnostic Agent

تقترح الورقة البحثية وكيل التشخيص ذاتي التعلم (SEA)، وهو وكيل يتميز بوحدة ذاكرة مزدوجة مستوحاة معرفياً وإطار تدريب تعزيزي يعمل على تحسين الاستدلال وإدارة الذاكرة بشكل مشترك، ليتفوق بشكل كبير على النماذج المرجعية في دقة التشخيص والتعلم المستمر من خلال تحويل الخبرة السريرية بفعالية إلى معرفة قابلة لإعادة الاستخدام.

Bingxuan Li, Simo Du, Yue Guo2026-04-09
💬 NLP

ClickGuard: A Trustworthy Adaptive Fusion Framework for Clickbait Detection

تقدم الورقة البحثية ClickGuard، وهو إطار عمل اندماجي تكيفي موثوق يدمج تضمينات BERT مع الميزات الهيكلية عبر كتلة اندماج تكيفية تركيبية-دلالية وهجين من CNN-BiLSTM لتحقيق دقة بنسبة 96.93% في كشف العناوين الخادعة مع ضمان القابلية للتفسير والمتانة من خلال تحليل LIME وأهمية الميزة بالتبديل.

Chhavi Dhiman, Naman Chawla, Riya Dhami, Gaurav Kumar, Ganesh Naik2026-04-09
💬 NLP

A Systematic Study of Retrieval Pipeline Design for Retrieval-Augmented Medical Question Answering

تقدم هذه الورقة تقييماً منهجياً للإجابة على الأسئلة الطبية المعززة بالاسترجاع على معيار MedQA USMLE، حيث تُظهر أن مسار الاسترجاع الكثيف مع إعادة صياغة الاستعلام وإعادة الترتيب يحقق دقة بنسبة 60.49%، مع تسليط الضوء على الأداء المتفوق للنماذج المتخصصة في المجال وإمكانية إجراء مثل هذه التقييمات على أجهزة استهلاكية.

Nusrat Sultana, Abdullah Muhammad Moosa, Kazi Afzalur Rahman, Sajal Chandra Banik2026-04-09
💬 NLP

Evaluating In-Context Translation with Synchronous Context-Free Grammar Transduction

تقيم هذه الورقة قدرة النماذج اللغوية الكبيرة على أداء الترجمة في السياق باستخدام القواعد النحوية الخالية من السياق المتزامنة كبديل رسمي للغات الطبيعية، وتجد أن الأداء يتدهور بشكل ملحوظ مع زيادة حجم القواعد وطول الجملة، ويتعثر بسبب الاختلافات المورفولوجية واختلاف الكتابة، ويتميز بأخطاء مثل الهلوسة المفرداتية والكلمات المصدرية غير المترجمة.

Jackson Petty, Jaulie Goe, Tal Linzen2026-04-09