💬 NLP

Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study

تتقصى هذه الدراسة التجريبية استراتيجيات تطوير نماذج لغوية كبيرة متعددة اللغات موثوقة تعمل كحكم (LLM-as-a-judge) عبر اللغات ذات الموارد العالية والمتوسطة والمنخفضة، كاشفةً أن النماذج الأصغر التي خضعت للضبط الدقيق تتفوق باستخدام البيانات المتخصصة في المجال، بينما تتفوق النماذج الأكبر التي تعمل بنمط التعلم الصفري في سيناريوهات خارج نطاق المجال، ومحذرةً من أن الضبط الدقيق خارج نطاق المجال يمكن أن يؤدي إلى تدهور الأداء.

Irune Zubiaga, Aitor Soroa, Rodrigo Agerri2026-05-28
💬 NLP

IPO-Mine: A Toolkit and Dataset for Section-Structured Analysis of Long, Multimodal IPO Documents

تقدم هذه الورقة IPO-Mine، وهي مجموعة أدوات مفتوحة المصدر ومجموعة بيانات متعددة الوسائط ضخمة ذات بنية مقسمة إلى أقسام تضم أكثر من 109,000 ملف من ملفات الاكتتاب العام و76,000 صورة، صُممت لتمكين التحليل المعياري للوثائق التنظيمية الطويلة والكشف عن فجوات محاذاة كبيرة بين النماذج متعددة الوسائط الحديثة وأحكام الخبراء البشريين.

Michael Galarnyk, Siddharth Lohani, Vidhyakshaya Kannan, Sagnik Nandi, Aman Patel, Liqin Ye, Arnav Hiray, Rutwik Routu (…)2026-05-28
🤖 AI

OpenURMA: A Clean-Room Open Implementation of the Unified Bus Protocol

تقدم هذه الورقة OpenURMA، وهي أول تنفيذ مفتوح المصدر بنظام الغرفة النظيفة لبروتوكول Huawei Unified Bus الخاص بشركة هواوي، والذي يثبت من خلال محاكاة RTL وSystemC وgem5 أن فصل حالة كل تطبيق عن حالة النقل يقلل زمن انتقال جلب البيانات عن بُعد بحجم 64 بايت بمقدار 4.37 ضعفاً ويزيد من معدل الإنتاجية بمقدار 2.80 ضعفاً مقارنة بالنماذج المرجعية التقليدية لـ RoCEv2.

Bojie Li2026-05-28
🤖 AI

LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know?

تكشف هذه الورقة أن وكلاء البحث القائمين على النماذج اللغوية الكبيرة الحاليين يعتمدون غالباً على المعرفة الذاتية بدلاً من البحث الحقيقي في الويب، مما استدعى تقديم LiveBrowseComp، وهو معيار مرجعي ديناميكي يستخدم حقائق حديثة وغير بارزة لتقييم قدرات الاكتشاف القائمة حقاً على الأدلة بفعالية.

HuiMing Fan, Xiao Wang, Zheng Chu, Qianyu Wang, Zhuoyao Wang, Ming Liu, Bing Qin, XingYu2026-05-28
🤖 AI

AlphaTransit: Learning to Design City-scale Transit Routes

تقدم الورقة البحثية AlphaTransit، وهو إطار عمل للتخطيط القائم على البحث يجمع بين بحث مونت كارلو في الأشجار وشبكة سياسة-قيمة عصبية لتصميم مسارات نقل على مستوى المدينة بفعالية من خلال التغلب على تحديات التغذية الراجعة المتأخرة، محققاً معدلات خدمة متفوقة في معيار Bloomington مقارنة بنهج التعلم المعزز المستقل أو نهج بحث مونت كارلو في الأشجار.

Bibek Poudel, Sai Swaminathan, Weizi Li2026-05-28
🧬 biology

BIRDNet: Mining and Encoding Boolean Implication Knowledge Graphs as Interpretable Deep Neural Networks

يُعد BIRDNet شبكة عصبية عميقة قابلة للتفسير تستخرج علاقات الاستلزام البولياني من البيانات الجدولية لبناء بنية متفرقة ومقيدة هيكليًا، محققةً أداءً تنافسيًا بعدد أقل بكثير من المعلمات مع تمكين الاستخراج المباشر لقواعد ذات معنى بيولوجي دون الحاجة إلى مسبقات خارجية.

Tirtharaj Dash2026-05-28✓ Author reviewed
💬 NLP

Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Models in Clinical Text

تقدم هذه الورقة "الاستقصاء العكسي" (Reverse Probing)، وهو إطار عمل مبتكر يستفيد من تنشيطات النموذج الداخلية لتقدير عدم اليقين على مستوى الرمز (token) في تلخيص النصوص السريرية دون الحاجة إلى أخذ عينات جديدة، مما يتفوق على النماذج المرجعية الحالية في الدقة والكفاءة مع توفير رؤى تفسيرية حول ثقة النموذج.

Bushi Xiao, Sarvesh Soni, Daisy Zhe Wang2026-05-28
🤖 AI

CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

تقدم الورقة البحثية خوارزمية CORE، وهي خوارزمية تعلم غير معلمية تعمل على تسريع تحسينات الاستدلال في النماذج اللغوية من خلال تقطير التباينات بين المسارات الناجحة وغير الناجحة إلى رؤى لغوية طبيعية مدمجة، محققةً أداءً فائقاً بعدد أقل من عينات التدريب وعمليات التشغيل مقارنة بالطرق المعلمية وغير المعلمية الحالية.

Linas Nasvytis, Simon Jerome Han, Ben Prystawski, Satchel Grant, Noah D. Goodman, Judith E. Fan2026-05-28
💬 NLP

Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

تُثبت هذه الورقة أنه في التعلم التعزيزي للكود، تُنشئ نقاط تفتيش التدريب ذات تغطية اختبارات الوحدة المتداخلة جبهةً بين الصحة والكفاءة يمكن التنقل فيها وتوسيعها إلى ما وراء النقاط النهائية المدربة عبر متوسط الأوزان الاستقرائي، مما يؤدي إلى تحسين أداء وقت الاستدلال وتغطية المشكلات دون تدريب إضافي.

Kunhao Zheng, Pierre Chambon, Juliette Decugis, Jonas Gehring, Taco Cohen, Benjamin Negrevergne, Gabriel Synnaeve2026-05-28
🤖 AI

CubePart: An Open-Vocabulary Part-Controllable 3D Generator

يُعد CubePart إطار عمل توليدي يتيح إنشاء نماذج ثلاثية الأبعاد (3D meshes) ذات مفردات مفتوحة وقابلة للتحكم في أجزائها، وذلك عبر استقبال مطالبات نصية عامة ومخططات أجزاء محددة من قبل المستخدم لإنتاج أصول متماسكة وجاهزة للتحريك، مُجمعة من مكونات دلالية مهيكلة بشكل صريح.

Yiheng Zhu, Kangle Deng, Jean-Philippe Fauconnier, Inaki Navarro, Daiqing Li, Ava Pun, Yinan Zhang, Peiye Zhuang, Xiaoxi (…)2026-05-28