💬 NLP

AblationBench: Evaluating Automated Planning of Ablations in Empirical AI Research

تقدم هذه الورقة AblationBench، وهي مجموعة اختبار مصممة لتقييم وكلاء النماذج اللغوية في مهام تخطيط الاستئصال في أبحاث الذكاء الاصطناعي التجريبية، كاشفةً أن النماذج الرائدة الحالية تقصر بشكل كبير مقارنة بالبشر ومسلطةً الضوء على الفعالية المتفوقة لأسلوب "سلسلة الأفكار" (chain-of-thought) في التلقين مقارنة بالنهج القائم على الوكلاء.

Talor Abramovich, Gal Chechik2026-02-03
💬 NLP

Beyond Content: How Grammatical Gender Shapes Visual Representation in Text-to-Image Models

تقدم هذه الورقة معيارًا عابرًا للغات يوضح أن النوع النحوي في لغات الأوامة (prompt languages) ينحاز بشكل كبير لمخرجات نماذج تحويل النص إلى صورة نحو الأجناس المرئية المقابلة، مما يكشف أن البنية اللغوية ذاتها، بما يتجاوز مجرد المحتوى الدلالي، تشكل التمثيلات المرئية المولدة بواسطة الذكاء الاصطناعي.

Muhammed Saeed, Shaina Raza, Ashmal Vayani, Muhammad Abdul-Mageed, Ali Emami, Shady Shehata2026-02-03
💬 NLP

Instructional Agents: Reducing Teaching Faculty Workload through Multi-Agent Instructional Design

تقدم هذه الورقة "الوكلاء التعليميين" (Instructional Agents)، وهو إطار عمل لنماذج لغوية كبيرة متعددة الوكلاء يعمل على أتمتة توليد المواد الدراسية من البداية إلى النهاية من خلال التعاون القائم على الأدوار، مما يقلل بشكل كبير من عبء العمل على أعضاء هيئة التدريس مع الحفاظ على الجودة التربوية عبر مختلف المساقات الجامعية.

Huaiyuan Yao, Wanpeng Xu, Justin Turnau, Nadia Kellam, Hua Wei2026-02-03
💬 NLP

GemDetox at TextDetox CLEF 2025: Enhancing a Massively Multilingual Model for Text Detoxification on Low-resource Languages

حقق نظام GemDetox، الذي يستفيد من نموذج Gemma-3 المكون من 12 مليار معلمة والمعزز بالضبط الدقيق الكفء للمعلمات، والتلقين بأسلوب القليل من الأمثلة، والسياق المعزز بالاسترجاع، مراكز متقدمة في تحدي CLEF 2025 لـ TextDetox من خلال إعادة صياغة النصوص السامة بفعالية إلى عبارات محايدة عبر اللغات ذات الموارد العالية والمنخفضة على حد سواء.

Trung Duc Anh Dang, Ferdinando Pio D'Elia2026-02-03
💬 NLP

DRIFT: Learning from Abundant User Dissatisfaction in Real-World Preference Learning

تقدم هذه الورقة البحثية إطار عمل DRIFT، وهو إطار عمل مبتكر لتعلم التفضيلات يستفيد من إشارات عدم الرضا الوفيرة للمستخدمين في العالم الحقيقي لأخذ عينات ديناميكية من الأمثلة الإيجابية، محققاً مكاسب كبيرة في الأداء مقارنة بالنماذج الأساسية والنماذج المرجعية القوية مع الحفاظ على تنوع الحلول وتجنب تدهور التدرج.

Yifan Wang, Bolian Li, Junlin Wu, Zhaoxuan Tan, Zheli Liu, Ruqi Zhang, Ananth Grama, Qingkai Zeng2026-02-03
💬 NLP

MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning

تقدم الورقة البحثية إطار عمل MARS، وهو إطار عمل جديد للتعلم المعزز متعدد الوكلاء يعمل على التطور المشترك لنظامين معرفيين مزدوجين (الحدس السريع والاستدلال المتأني) للتغلب على عدم كفاءة الرموز (tokens) والقيود المعرفية لنماذج الاستدلال الكبيرة، محققاً أداءً هو الأفضل في فئته في المهام كثيفة المعرفة دون الحاجة إلى ضبط دقيق تحت الإشراف.

Guoxin Chen, Zile Qiao, Wenqing Wang, Donglei Yu, Xuanzhong Chen, Hao Sun, Minpeng Liao, Kai Fan, Yong Jiang, Penguin Xi (…)2026-02-03
💬 NLP

WUGNECTIVES: Novel Entity Inferences of Language Models from Discourse Connectives

تقدم هذه الورقة البحثية WUGNECTIVES، وهي مجموعة بيانات مصممة لتقييم كيفية استنتاج النماذج اللغوية لسمات الكيانات الجديدة من الروابط اللغوية، مما يكشف أنه بينما يحسن الضبط أداء الاستدلال، إلا أن النماذج تعاني باستمرار مع الروابط التنازلية.

Daniel Brubaker, William Sheffield, Junyi Jessy Li, Kanishka Misra2026-02-03
💬 NLP

Entropy Meets Importance: A Unified Head Importance-Entropy Score for Stable and Efficient Transformer Pruning

تقدم هذه الورقة البحثية HIES، وهو معيار تقليم موحد يجمع بين درجات أهمية الرأس (Head Importance Scores) وبين اعتلاج الانتباه (attention entropy) للتغلب على قيود الطرق القائمة على التدرج، محققاً تحسينات ملحوظة في جودة النموذج واستقراره من أجل ضغط نماذج المحولات (Transformer) بكفاءة.

Minsik Choi, Hyegang Son, Changhoon Kim, Young Geun Kim2026-02-03
💬 NLP

Recursive numeral systems are highly regular and easy to process

تجادل هذه الورقة بأن دمج الانتظام وتعقيد المعالجة من خلال إطار عمل طول الوصف الأدنى (MDL) يفسر بشكل أفضل بنية الأنظمة العددية العودية، ويفسر بشكل طبيعي القيود التي تطلبت النماذج السابقة القائمة على الكفاءة فرضها بشكل تعسفي.

Ponrawee Prasertsom, Andrea Silvi, Jennifer Culbertson, Moa Johansson, Devdatt Dubhashi, Kenny Smith2026-02-03