💬 NLP

LADDER: Language-Driven Slice Discovery and Error Rectification in Vision Classifiers

يُعد LADDER إطار عمل مبتكر يسخر النماذج اللغوية الكبيرة لاكتشاف شرائح خطأ متماسكة ومدفوعة باللغة وتوليد سمات زائفة للتخفيف الشامل من الانحياز في مصنفات الرؤية، متجاوزاً بذلك قيود طرق التجميع والأسالسة القائمة على السمات عبر دمج المعرفة بالمجال والاستدلال المتقدم دون الحاجة إلى تسميات توضيحية صريحة.

Shantanu Ghosh, Rayan Syed, Chenyu Wang, Vaibhav Choudhary, Binxu Li, Clare B. Poynton, Shyam Visweswaran, Kayhan Batman (…)2026-08-07
🤖 AI

OM4OV: Leveraging Ontology Matching for Ontology Versioning

تقدم هذه الورقة إطار عمل OM4OV وآلية تحسين المرجعية المتقاطعة لمعالجة أوجه القصور في إعادة استخدام أنظمة مطابقة الأنطولوجيا مباشرة لغرض إصدار النسخ من الأنطولوجيا، وذلك من خلال تحسين اكتشاف كيانات التحديث ودقة قياسات التغيير.

Zhangcheng Qiang, Kerry Taylor, Weiqing Wang2026-08-07
🤖 AI

Reward Shaping to Mitigate Reward Hacking in RLHF

تقترح هذه الورقة البحثية "التفضيل كعقاب" (PAR)، وهي طريقة مبتكرة لتشكيل المكافأة ترتكز على مبادئ المحدودية والنمو الأولي السريع الذي يليه التشبع، وذلك للحد بفعالية من اختراق المكافأة وتثبيت تدريب التعلم المعزز من التغذية الراجعة البشرية (RLHF).

Jiayi Fu, Xuandong Zhao, Chengyuan Yao, Heng Wang, Qi Han, Yanghua Xiao2026-08-07
💬 NLP

Shrinking the Generation-Verification Gap with Weak Verifiers

تقدم الورقة البحثية "Weaver"، وهو إطار عمل يستفيد من الإشراف الضعيف لدمج العديد من الموثقات الضعيفة وغير المثالية في موثق قوي وقابل للتوسع، مما يقلص بشكل كبير فجوة الأداء بين حكام النماذج اللغوية الحاليين والموثقات المثالية (oracle verifiers) لتحقيق دقة بمستوى "o3-mini" دون الحاجة إلى ضبط دقيق واسع النطاق.

Jon Saad-Falcon, E. Kelly Buchanan, Mayee F. Chen, Tzu-Heng Huang, Brendan McLaughlin, Tanvir Bhathal, Shang Zhu, Ben At (…)2026-08-07
💬 NLP

Building Open-Retrieval Conversational Question Answering Systems by Generating Synthetic Data and Decontextualizing User Questions

تقترح هذه الورقة مسار عمل لتوليد مجموعات بيانات استرجاع مفتوح للإجابة على الأسئلة الحوارية (OR-CONVQA) اصطناعية وموسومة تلقائياً من وثائق نصية بسيطة، والتي تُستخدم بعد ذلك لتدريب أدوات إعادة كتابة الأسئلة الفعالة التي تمكّن أنظمة الاسترجاع والنماذج اللغوية الكبيرة الحالية من التعامل مع استجابات مدركة للحوار ومستندة إلى الوثائق.

Christos Vlachos, Nikolaos Stylianou, Alexandra Fiotaki, Spiros Methenitis, Elisavet Palogiannidi, Themos Stafylakis, Io (…)2026-08-07
💬 NLP

All-Quadrant Bounded Clipping GRPO: Closing the Unbounded Blind Spot for Stable and Generalizable Training

تقدم هذه الورقة خوارزمية ABC-GRPO (التقليم المقيد بجميع الأرباع لـ GRPO)، وهي خوارزمية تعلم تعزيزي مبتكرة تعالج عدم المحدودية الهيكلية في ربع الميزة السالبة في خوارزمية GRPO القياسية عن طريق تطبيق تقليم غير مشروط لضمان تدريب مستقر وعالي الإنتروبيا وتعميم فائق في معايير الرياضيات والبرمجة.

Chi Liu, Xin Chen2026-08-07
💬 NLP

Can Deep Research Agents Retrieve and Organize? Evaluating the Synthesis Gap with Expert Taxonomies

تقدم هذه الورقة TaxoBench، وهو معيار مرجعي يوضح أن وكلاء البحث العميق الحاليين يتخلفون بشكل كبير عن الخبراء البشريين في كل من استرجاع الأوراق الأساسية وتنظيمها في تصنيفات متماسكة، مما يكشف عن اختناقات متميزة في دقة الاسترجاع وتوليف الهيكل الهرمي.

Ming Zhang, Jiabao Zhuang, Wenqing Jing, Kexin Tan, Ziyu Kong, Jingyi Deng, Yujiong Shen, Yuhui Wang, Zhenghao Xiang, Qi (…)2026-08-07
💬 NLP

STATe-of-Thoughts: Structured Action Templates for Tree-of-Thoughts

تقدم الورقة البحثية "STATe-of-Thoughts" (STATe)، وهي طريقة قابلة للتفسير للحوسبة أثناء الاستدلال، تعمل على تحسين تنوع المخرجات والتحكم في الاستدلال من خلال البحث عبر أنماط أفعال نصية عالية المستوى ومنفصلة بدلاً من الاعتماد على أخذ عينات مستوى الرمز (token) باستخدام درجة الحرارة (temperature).

Zachary Bamberger, Till R. Saenger, Gilad Morad, Ofra Amir, Brandon M. Stewart, Amir Feder2026-08-07
💬 NLP

Large Language Models Threaten Double-blind Review

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة يمكنها كشف هوية المؤلفين بفعالية في عمليات مراجعة الأقران مزدوجة التعمية من خلال تحديد البصمات المفاهيمية المستقرة في العناوين والملخصات، مما يهدد نزاهة نظام المراجعة الحالي.

Bulambo Mwendelwa Gloire, Prasenjit Mitra2026-08-07
🤖 AI

The Ignition Index: Measuring Global Workspace Dynamics in Language Models

تقدم هذه الورقة "مؤشر الاشتعال" (Ignition Index)، وهو مقياس عددي تم التحقق من صحته يكمّم ظاهرة "الكل أو لا شيء" الخاصة بنظرية مساحة العمل العالمية في نماذج لغة المحولات، وذلك عبر تحليل انتقالات دقة المسبار السيني (sigmoidal probe accuracy transitions)، مما يكشف عن بصمات ديناميكية متميزة عبر البنيات ومراحل التدريب التي تميز المعالجة اللغوية الحقيقية عن الأنماط الزائفة.

Saman Rahbar2026-08-07