💬 NLP

BiomedSQL: Text-to-SQL for Scientific Reasoning on Biomedical Knowledge Bases

تقدم الورقة البحثية BiomedSQL، وهو أول معيار مصمم لتقييم الاستدلال العلمي في توليد لغة SQL من النصوص عبر قاعدة معرفة طبية حيوية واقعية، كاشفةً عن فجوات أداء كبيرة بين النماذج اللغوية الكبيرة الحالية والأسس الخبيرة في التعامل مع المعايير المعقدة الخاصة بالمجال.

Mathew J. Koretsky, Maya Willey, Owen Bianchi, Chelsea X. Alvarado, Tanay Nayak, Nicole Kuznetsov, Sungwon Kim, Mike A. (…)2026-03-18
💬 NLP

Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models

تقترح هذه الورقة طريقة استقصاء موجهة باليقين تعمل على تجميع الحالات الخفية على مستوى الرمز (token) لتحسين اكتشاف التخليقات (confabulations) في النماذج اللغوية الكبيرة، كاشفةً أنه بينما يمكن للسياق المضلل أن يستحث استجابات خاطئة واثقة، فإن الاستفادة من اليقين العشوائي (aleatoric) واليقين المعرفي (epistemic) تعزز بشكل كبير تقدير الموثوقية عبر النماذج مفتوحة المصدر.

Tianyi Zhou, Johanne Medina, Sanjay Chawla2026-03-18
💬 NLP

Transformer-Encoder Trees for Efficient Multilingual Machine Translation and Speech Translation

تقدم هذه الورقة أشجار مشفرات المحولات (TET)، وهي بنية هرمية غير ذاتية الانحدار تعتمد على المشفر فقط، تشارك التمثيلات الوسيطة بين اللغات المتشابهة لغويًا لتقليل الحشو الحسابي وعدد المعلمات بشكل كبير مع تحسين جودة الترجمة للغات ذات الموارد المنخفضة وتمكين الترجمة المتعددة اللغات والترجمة الكلامية المتوازية بالكامل في تمريرة واحدة.

Yiwen Guan, Jacob Whitehill2026-03-18
💬 NLP

SiniticMTError: A Machine Translation Dataset with Error Annotations for Sinitic Languages

تقدم هذه الورقة البحثية SiniticMTError، وهي مجموعة بيانات جديدة دقيقة التفاصيل تتميز بتعليقات توضيحية لنطاق الخطأ، ونوعه، وشدته للأمثلة المترجمة آلياً عبر عدة لغات صينية (الماندارين، والكانتونية، والوو، والهوكين)، والمصممة للنهوض بتقدير جودة الترجمة والتوليد المدرك للأخطاء مع تسليط الضوء على القيود الحالية للنماذج اللغوية الكبيرة في اكتشاف مثل هذه الأخطاء.

Hannah Liu, Junghyun Min, En-Shiun Annie Lee, Ethan Yue Heng Cheung, Shou-Yi Hung, Elsie Chan, Shiyao Qian, Runtong Lian (…)2026-03-18
💬 NLP

When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models

تُثبت هذه الورقة أن المدخلات الصوتية غير ذات الصلة، بما في ذلك الصمت والضجيج، تُضعف بشكل كبير أداء الاستنتاج النصي واستقرار نماذج اللغة الصوتية الكبيرة، مما يكشف عن تحدٍ حرج يتمثل في التداخل عبر الوسائط والذي لا تعالجه استراتيجيات التخفيف الحالية إلا جزئياً.

Chen-An Li, Tzu-Han Lin, Hung-yi Lee2026-03-18
💬 NLP

Compressed Convolutional Attention: Efficient Attention in a Compressed Latent Space

تقدم هذه الورقة البحثية آلية الانتباه التلافيفي المضغوط (CCA) ومتغيرها CCGQA، وهما آليتان مبتكرتان للانتباه تقومان بالعمليات في فضاء كامن مشترك لتقليل عدد المعلمات، وحجم ذاكرة التخزين المؤقت لـ KV، وعمليات الفاصلة العائمة (FLOPs) في آن واحد، مما يحقق تسريعاً كبيراً في عمليات التدريب والتحميل المسبق مع الحفاظ على الأداء أو تحسينه مقارنة بالطرق الحالية مثل GQA وMLA.

Tomas Figliolia, Nicholas Alonso, Rishi Iyer, Quentin Anthony, Beren Millidge2026-03-18
💬 NLP

Readers Prefer Outputs of AI Trained on Copyrighted Books over Expert Human Writers

تُظهر هذه الدراسة أنه في حين يفضل كل من القراء العامين والكتاب الخبراء المتدربين في برامج الماجستير في الفنون الجميلة النصوص المولدة بواسطة الذكاء الاصطناعي والمعدلة بدقة بناءً على أعمال مؤلفين محميين بحقوق الطبع والنشر على المحاكاة البشرية، فإن القراء العامين يبدون تفضيلاً أقوى بكثير لجودة الذكاء الاصطناعي، مما يشير إلى أن عملية التعديل الدقيق منخفضة التكلفة تمكن الذكاء الاصطناعي من إنتاج محاكاة أسلوبية متفوقة ذات صلة باعتبارات الاستخدام العادل لحقوق الطبع والنشر.

Tuhin Chakrabarty, Jane C. Ginsburg, Paramveer Dhillon2026-03-18
💬 NLP

Surfacing Subtle Stereotypes: A Multilingual, Debate-Oriented Evaluation of Modern LLMs

تقدم هذه الورقة \corpusname، وهو معيار تقييم متعدد اللغات يعتمد أسلوب المناظرة، يكشف أنه على الرغم من محاذاة السلامة، تعيد النماذج اللغوية الكبيرة الرائدة إنتاج الصور النمطية الراسخة باستمرار عبر سبع لغات، مع اشتداد التحيزات في السياقات ذات الموارد المنخفضة حيث تفشل المحاذاة المدربة باللغة الإنجليزية في التعميم.

Muhammed Saeed, Muhammad Abdul-mageed, Shady Shehata2026-03-18
💬 NLP

Language as a Wave Phenomenon: Semantic Phase Locking and Interference in Neural Networks

تقدم هذه الورقة البحثية PRISM، وهو مشفر ذو قيم مركبة يفرض قيود الوحدة المعيارية ليثبت أن المعلومات الدلالية يمكن تشفيرها بفعالية عبر زوايا الطور من خلال آليات مثل التماسك والتداخل، محققاً أداءً تنافسياً مع نماذج Transformer القياسية مع الكشف عن ظروف محددة لنجاحه وفشله.

Alper Yıldırım, İbrahim Yücedağ2026-03-18