🤖 machine learning

HERCULES: Hardware-Efficient, Robust, Continual Learning Neural Architecture Search

تقدم هذه الورقة البحثية HERCULES، وهو إطار عمل وتصنيف جديد للبحث عن البنى العصبية (Neural Architecture Search) يوحد الأهداف الجوهرية المتمثلة في كفاءة الأجهزة، والمتانة، والتعلم المستمر لتوجيه تطوير أنظمة الذكاء الاصطناعي القابلة للنشر والتعلم مدى الحياة.

Matteo Gambella, Fabrizio Pittorino, Manuel Roveri2026-05-07
💻 computer science

TSCG: Deterministic Tool-Schema Compilation for Agentic LLM Deployments

إن TSCG هو مترجم لمخططات الأدوات حتمي وخالٍ من التبعيات، يعمل على تحسين دقة استخدام الأدوات بشكل كبير للنماذج اللغوية الكبيرة الصغيرة والمتقدمة في بيئات الإنتاج عبر تحويل مخططات JSON غير الفعالة إلى نصوص مهيكلة موفرة للرموز (tokens)، مما يؤدي إلى حل مشكلة عدم تطابق التنسيق التي تتسبب حالياً في غالبية أخطاء استخدام الأدوات.

Furkan Sakizli2026-05-07
🤖 machine learning

Position: the Stochastic Parrot in the Coal Mine. Model Collapse is a Threat to Low-Resource Communities

تجادل ورقة الموقف هذه بأن الانهيار النموذجي، الناجم عن تدريب الذكاء الاصطنا التوليدي على مخرجاته الخاصة، يهدد بدمقرطة الذكاء الاصطناعي من خلال تدهور جودة البيانات وكفاءتها، مما يلحق ضرراً غير متناسب بالمجتمعات ذات الموارد المنخفضة والمهمشة عبر تعزيز التحيزات الثقافية والتكاليف البيئية.

Devon Jarvis, Richard Klein, Benjamin Rosman, Steven James, Stefano Sarao Mannelli2026-05-07
💻 computer science

Frontier Lag: A Bibliometric Audit of Capability Misrepresentation in Academic AI Evaluation

يقدم هذا العمل فحصاً بيبليومترياً يظهر أن التقييمات الأكاديمية لقدرات الذكاء الاصطناعي تتخلف بشكل منهجي عن الحالة الراهنة لأحدث ما توصل إليه العلم بأكثر من عقد من الزمان، وهي فجوة تتسع بسبب تأخيرات النشر وتتفاقم بسبب التضليل الواسع النطاق لتكوينات النماذج، وكذلك بسبب الادعاءات شديدة التعميم حول "الذكاء الاصطناعي" بدلاً من الأنظمة التي تم تقييمها تحديداً.

David Gringras, Misha Salahshoor2026-05-07
💬 NLP

FMI_SU_Yotkova_Kastreva at SemEval-2026 Task 13: Lightweight Detection of LLM-Generated Code via Stylometric Signals

تقدم هذه الورقة نهجاً يعتمد على وحدة المعالجة المركزية (CPU) ويكون فعالاً من الناحية الحسابية للكشف عن الكود المولد بواسطة النماذج اللغوية الكبيرة في SemEval-2026 المهمة 13 الفرع أ، والذي يجمع بين الميزات القائمة على النسب المتينة تجاه الطول، وأدوات التحليل، ومصنف "الكود مقابل النص" باستخدام شجرة قرار ضحلة وقواعد استدلالية لتحقيق استدلال شبه فوري دون الاعتماد على نماذج مدربة مسبقاً ضخمة.

Elitsa Yotkova, Violeta Kastreva, Dimitar Dimitrov, Ivan Koychev, Preslav Nakov2026-05-07
💬 NLP

Are LLMs Ready for Conflict Monitoring? Empirical Evidence from West Africa

تُثبت هذه الورقة تجريبياً أنه في حين تعمل النماذج المتكيفة مع المجال على التخفيف من التحيز المعياري في مراقبة الصراعات في غرب أفريقيا، إلا أن النماذج اللغوية الكبيرة الحالية تظل غير صالحة للنشر غير الخاضع للإشراف بسبب تحيزات الاختيار المستمرة القائمة على الفاعلين، والهشاشة الجغرافية تجاه التأطير اللفظي، وتخيلات التعليل غير المخلصة.

Hoffmann Muki, Olukunle Owolabi2026-05-07
💬 NLP

MedFabric and EtHER: A Data-Centric Framework for Word-Level Fabrication Generation and Detection in Medical LLMs

تقدم هذه الورقة MedFabric، وهو مسار قائم على البيانات لتوليد تزييفات طبية واقعية على مستوى الكلمات، وETHER، وهو كاشف معياري يستفيد من هذه المجموعة من البيانات ليتفوق بشكل كبير على الأساليب الحالية الرائدة في تحديد الانحرافات الواقعية الدقيقة ضمن مخرجات النماذج اللغوية الكبيرة الطبية.

Tung Sum Thomas Kwok, Qian Qian, Xiaofeng Lin, Dongxu Zhang, Jun Han, Zhichao Yang, Davin Hill, Tamer Soliman, Sanjit Si (…)2026-05-07
💬 NLP

Nsanku: Evaluating Zero-Shot Translation Performance of LLMs for Ghanaian Languages

تقدم هذه الورقة البحثية "نسانكو" (Nsanku)، وهو معيار شامل لتقييم أداء الترجمة من نوع "التعلم الصفري" لـ 19 نموذجاً من نماذج اللغات الكبيرة عبر 43 لغة غانية، كاشفةً أنه في حين تحقق النماذج الرائدة مثل "Gemini-2.5-flash" درجات متوسطة، إلا أنه لا يوجد نموذج حالي يُظهر في آن واحد أداءً عالياً واتساقاً، مما يشير إلى أنها ليست جاهزة بعد للاستخدام الموثوق في الترجمة واسعة النطاق لهذه اللغات.

Stephen E. Moore, Mich-Seth Owusu, Akwasi Asare, Lawrence Adu Gyamfi, Paul Azunre, Joel Budu, Jonathan Asiamah, Elias Dz (…)2026-05-07
🤖 machine learning

Jordan-RoPE: Non-Semisimple Relative Positional Encoding via Complex Jordan Blocks

تقدم هذه الورقة Jordan-RoPE، وهو ترميز موضعي نسبي غير بسيط (non-semisimple) يستفيد من كتل جوردان المعقدة لتوليد سمات تذبذبية-متعددة الحدود لنمذجة التفاعلات الطورية المعدلة بالمسافة، مما يظهر مزايا هيكلية ومكاسب أداء محددة على خطوط الأساس القياسية لـ RoPE وALiBi في سياقات معينة.

Yaobo Zhang2026-05-07✓ Author reviewed
💬 NLP

Material Database Agent: A Multimodal Agentic Framework for Scientific Literature Mining

تقدم الورقة البحثية "وكيل قاعدة بيانات المواد" (Material Database Agent - MDA)، وهو إطار عمل متعدد الوكلاء، متعدد الوسائط، وتركيبي، يعمل على أتمتة استخراج البيانات المهيكلة من ملفات PDF الخاصة بالأدبيات العلمية لبناء قواعد بيانات مواد على نطاق إنتاجي بكفاءة.

Achuth Chandrasekhar, Omid Barati Farimani, Radheesh Sharma Meda, Amir Barati Farimani2026-05-07