🧬 biology

EpiBench: Can LLMs Understand Epitopes for Antibody Drug Discovery?

تقدم هذه الورقة EpiBench، وهو معيار شامل قائم على التسلسل مصمم لتقييم وتشخيص أوجه القصور في النماذج اللغوية الكبيرة الحالية في الاستنتاج حول الحواتم (epitopes) لاكتشاف الأدوية المضادة للأجسام المضادة، مما يكشف عن قدرتها الجزئية ولكن مع وجود فجوات كبيرة في التأسيس التسلسلي والاستنتاج البيولوجي الدقيق.

Zirui Wang, Jiaqi Wang, Qinghan Wang, Yuzhi Xu, Gang Du, Tingjun Hou, Odin Zhang2026-08-07
💬 NLP

LangChoiceBench: Measuring and Explaining Programming-Language Choice in LLMs

تقدم هذه الورقة LangChoiceBench، وهو معيار مرجعي يكشف أن النماذج اللغوية الكبيرة تظهر تفضيلاً قوياً، وغير مبرر غالباً، للغة بايثون في توليد الأكواد البرمجية على مستوى المشاريع، ويتميز ذلك بانخفاض الاتساق بين الاستدلال والتنفيذ، ومحدودية التنوع اللغوي، والميل إلى فبركة أدلة سياقية لدعم خياراتها.

Lukas Twist, Twm Stone, Helen Yannakoudakis, Jie M. Zhang2026-08-07
💬 NLP

Beyond Sequence Order: Syntax-Informed Positional Embeddings for Transformers

تقدم الورقة البحثية "التمثيلات الموضعية المستنيرة بالبنية النحوية" (SiPE)، وهي طريقة خفيفة الوزن تعمل على حقن معلومات الإعراب التبعي في مختلف عائلات التموضع الموضعي لنموذج المحول (Transformer) لتحسين الفهم النحوي والأداء اللغوي العام بشكل كبير دون زيادة تكاليف الاستدلال.

Haris Riaz, Hyungji Kim, Mihai Surdeanu2026-08-07
🤖 AI

From Siloed Algorithms to Compliance-First Agentic Platforms: A Multi-Layered Architecture for Hospital AI Systems

تقترح هذه الورقة بنية للذكاء الاصطناج الوكيل (Agentic AI) متعددة الطبقات وتضع الامتثال في المقدمة، تدمج بين التنسيق، وإنفاذ السياسات، وأنسجة البيانات الحافظة للخصوصية لتحويل عمليات نشر الذكاء الاصطناعي المجزأة في المستشفيات إلى منصة مؤسسية قابلة للتوسع، ومُحكمة، ومتوافقة عالمياً.

Manideep Dhar, Ritwik Singh, Sharat Chandra Kumar Manikonda2026-08-07
💬 NLP

Decolonizing Linguistic Policies in Automated Speech Recognition: A Framework for Cross-Culturally Competent Speech AI

تجادل هذه الورقة بأن الإخفاقات في التعرف التلقائي على الكلام للغات ذات الموارد المنخفضة ولغات الشعوب الأصلية هي تجليات لسياسات لغوية استعمارية، وتقترح إطاراً لإنهاء الاستعمار يتميز بتصنيف "الأضرار الثلاثة" ونموذج حوكمة تشاركي لتحقيق ذكاء اصطناعي صوتي كفء عابر للثقافات.

Jay L. Cunningham, Mark Atta Mensah, Richard Martinez, Joao Vieira da Silva Neto, Efi Dawodu2026-08-07
💬 NLP

NeSy-RAG: Neuro-Symbolic RAG for Explainable Question Answering

يُعد NoSy-RAG إطار عمل توليدي معزز بالاسترجاع عصبي-رمزي معياري يقوم بتوليف وحدات برولوج (Prolog) قابلة للعزو من النصوص المسترجعة لتقديم إجابات شفافة وحتمية والكشف تلقائياً عن سياق المستخدم المفقود، محققاً دقة فائقة مقارنة بالنماذج المرجعية القياسية لتقنية RAG في اختبار ShARC.

Jonas Gann, Michael Gertz2026-08-07
🤖 AI

HarnessOpt-Bench: Evaluating LLMs at Harness Optimization

تقدم هذه الورقة HarnessOpt-Bench، وهو معيار مرجعي جديد صُمم لتقييم قدرة النماذج اللغوية الكبيرة الرائدة على تحسين أطر العمل الوكيلة (بما في ذلك المطالبات، والأدوات، وكود التنسيق) بشكل تكراري تحت قيود الموارد، مما يثبت أن قدرة التحسين هذه هي مهارة متميزة وقابلة للقياس مع وجود مجال كبير للتحسين.

Varun Ursekar, Apaar Shanker, Yash Maurya, Shehab Yasser, Vijay S. Kalmath, Veronica Chatrath, Yuan Xue2026-08-07
💬 NLP

RP-OPSD: Reasoning-Pivot-Guided On-Policy Self-Distillation for Multilingual Reasoning Transfer

تقترح الورقة البحثية RP-OPSD، وهي طريقة مبتكرة تعزز نقل الاستدلال متعدد اللغات من خلال توجيه التقطير الذاتي في الوقت الفعلي (on-policy self-distillation) لإعطاء الأولوية لـ "محاور الاستدلال" (reasoning pivots) على النصوص السطحية، مما يتفوق على النماذج المرجعية الحالية عبر 17 لغة.

Xinye Wang, Junxiao Liu, Shujian Huang2026-08-07
🤖 machine learning

CalibForge: Adversarial Solver Calibration for Scaling Learnable Terminal Tasks

تقدم هذه الورقة CalibForge، وهو نظام ذاتي يقوم بتخليق مهام تدريب نهائية فعالة باستخدام معايرة الحلّال التنافسي لتحديد "منطقة قابلة للتعلم" تكون فيها المهام قابلة للحل ولكنها صعبة في الوقت ذاته، مما يؤدي إلى مكاسب كبيرة في الأداء عبر معايير قياسية متعددة للوكلاء مقارنة بطرق تنسيق البيانات التقليدية.

Fanzhe Meng, Guoxin Chen, Jiale Zhao, Shuang Sun, Zhiyu Lin, Wayne Xin Zhao, Ruihua Song, Ji-Rong Wen, Kai Jia2026-08-07
💬 NLP

The Bitter Lesson of Tool Calling

تثبت هذه الورقة تجريبياً أن استدعاء الأدوات البرمجي، الذي يستخدم نماذج بايثون النوعية (Python stubs) لاستدعاء الأدوات، هو بديل قوي وغالباً ما يكون متفوقاً على استدعاء الأدوات عبر صيغة JSON الأصلية عبر مختلف النماذج اللغوية والظروف الصعبة مثل التنفيذ المتوازي وتدهور السياق.

Ishan Patel, Sahil Sen, Elias Lumer, Vamse Kumar Subbiah2026-08-07