💬 NLP

From 0-Order Selection to 2-Order Judgment: Combinatorial Hardening Exposes Compositional Failures in Frontier LLMs

تقدم هذه الورقة LogiHard، وهو إطار عمل رسمي يحول مهام الاختيار البسيطة إلى أحكام منطقية معقدة عبر التصلب التوافقي والاختبار التكيفي، كاشفاً أن النماذج اللغوية الكبيرة الرائدة تعاني من تدهور كبير في الدقة بسبب فجوة استدلال توافقي ناتجة عن التدريب وليس بسبب نقص في المعرفة.

Hanmeng Liu, Shichao Weng, Xiulai Liu, Zhicai Zhang, Anli Yan, Xiaozhang Liu2026-05-11
💬 NLP

MIPIAD: Multilingual Indirect Prompt Injection Attack Defense with Qwen -- TF-IDF Hybrid and Meta-Ensemble Learning

تقدم الورقة البحثية MIPIAD، وهو إطار دفاعي متعدد اللغات ضد هجمات حقن الأوامر غير المباشرة يجمع بين مصنف Qwen2.5 مضبوط بدقة باستخدام تقنية LoRA مع ميزات TF-IDF وتعلم التجميع الميتا (meta-ensemble learning) لتحقيق دقة كشف عالية وتقليل فجوات الأداء عبر اللغات في الإنجليزية والبنجالية.

Al Muhit Muhtadi, Mostafa Rifat Tazwar2026-05-11
💬 NLP

On the Complexity of the Matching Problem of Regular Expressions with Backreferences

تحدد هذه الورقة التعقيد الحسابي دقيق التفاصيل لمطابقة التعبيرات المنتظمة مع المراجع الخلفية من خلال إثبات الحدود الدنيا المشروطة تحت افتراضات SETH واكتشاف المثلث، بينما تقدم خوارزمية محسنة بقدر O(nlog2n)O(n \log^2 n) للمراجع الخلفية ذات الاستخدام الواحد.

Soh Kumabe, Yuya Uezato2026-05-11
💬 NLP

MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs

تقدم الورقة البحثية MedAction، وهو مسار تقطير ذو بنية شجرية يولد مسارات تشخيص سريري متعددة الأدوار عالية الجودة باستخدام مقاييس مرتكزة على الرسوم البيانية للمعرفة لمعالجة أوجه القصور في النماذج اللغوية الكبيرة الحالية في التشخيص النشط، مما أدى إلى إنتاج مجموعة بيانات MedAction-32K ونماذج طبية مفتوحة المصدر ذات أداء فائق.

Hsin-Ling Hsu, Zizheng Wang, Donghua Zhang, Nai-Chia Chen, Jerry Wang, Jun-En Ding, Chia-Hsuan Hsu, Guoan Wang, Feng Liu (…)2026-05-11
💬 NLP

Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts

تتحدى هذه الورقة الرؤية التقليدية التي تقضي بوجوب كون سلاسل الاستدلال كثيفة ومتسلسلة، وذلك من خلال إثبات قدرة النماذج اللغوية على استخراج الإجابات الصحيحة من آثار الاستدلال التي تعرضت لخلط شديد، وتجريد من اللغة الطبيعية، وحتى تلوث بإجابات خاطئة، مما يكشف عن ركيزة معلوماتية كامنة تتسم بالندرة وعدم الحساسية للترتيب.

Yi-Chang Chen, Feng-Ting Liao, Da-shan Shiu, Hung-yi Lee2026-05-11
💬 NLP

Gradient-Based LoRA Rank Allocation Under GRPO: An Empirical Study

تكشف هذه الدراسة التجريبية أن تخصيص الرتب التكيفي القائم على التدرج لتقنية LoRA، رغم فعاليته في الضبط الدقيق الخاضع للإشراف، يؤدي إلى تدهور الأداء بشكل كبير في ظل عملية تحسين السياسة النسبية الجماعية (GRPO) بسبب مشهد تدرج أكثر تسطحاً وتأثير تضخيم التدرج الضار، مما يشير إلى أن تخصيص الرتب الموحد يعد متفوقاً لمهام محاذاة التعلم المعزز.

Yash Ganpat Sawant2026-05-11
💬 NLP

Unsolvability Ceiling in Multi-LLM Routing: An Empirical Study of Evaluation Artifacts

تكشف هذه الدراسة التجريبية أن "سقوف عدم القدرة على الحل" المُبلغ عنها في توجيه النماذج اللغوية الكبيرة المتعددة (multi-LLM routing) مبالغ فيها إلى حد كبير بسبب عيوب تقييمية مثل انحياز الحكم والقص، مما يشوه إشارات تدريب الموجه ويؤدي إلى تكاليف فرصة بديلة كبيرة، مما يستلزم بروتوكولات تقييم أكثر موثوقية لتقدير المقايضات بين التكلفة والجودة بدقة.

Saloni Garg, Amit Sagtani2026-05-11
💬 NLP

The Proxy Presumption: From Semantic Embeddings to Valid Social Measures

تتناول هذه الورقة "افتراض الوكيل" في العلوم الاجتماعية الحوسبية من خلال تقديم "بروتوكول صلاحية البناء" (CVP) و"التحييد المقابل للواقع" للتحقق بدقة من صحة التضمينات الدلالية، بما يضمن قياسها للمفاهيم الاجتماعية بدلاً من السمات المربكة مثل الموضوع أو الأسلوب.

Baishi Li, Ta Yu, Kelvin J. L. Koa, Ke-Wei Huang2026-05-11
💬 NLP

SSP-based construction of evaluation-annotated data for fine-grained aspect-based sentiment analysis

تقدم هذه الورقة بناء مجموعة بيانات التقييم الكورية (EVAD) باستخدام الانتشار الرمزي شبه الآلي (SSP) والمحوّلات ذات الحالة النهائية لتوسيع تحليل المشاعر القائم على الجوانب لمراجعات التجارة الإلكترونية من خلال دمج قيم الجوانب، محققةً درجات F1 عالية بلغت 0.88 و0.90 باستخدام نموذجي KoBERT وKcBERT.

Suwon Choi, Shinwoo Kim, Changhoe Hwang, Gwanghoon Yoo, Eric Laporte, Jeesun Nam2026-05-11
💬 NLP

Data Contamination in Neural Hieroglyphic Translation: A Reproducibility Study

تكشف هذه الدراسة أن درجة "بلي" (BLEU) البالغة 61.5 التي تم الإبلاغ عنها سابقاً لترجمة الهيروغليفية إلى الألمانية قد تضخمت اصطناعياً بسبب تلوث بيانات الاختبار بنسبة 2%، ومن خلال إزالة التلوث الصارمة، تُحدد الدراسة نطاق أداء أساسي واقعي يتراوح بين 30.9 و39.2 درجة "بلي" لهذا النظام الكتابي المهدد بالانقراض.

Ammar Toutou, Abdelrahman Harb, Christine Basta2026-05-11