🤖 AI

Nudging Beyond the Comfort Zone: Efficient Strategy-Guided Exploration for RLVR

تقدم هذه الورقة NudgeRL، وهو إطار عمل يعزز التعلم التعزيزي بالمكافآت القابلة للتحقق (RLVR) من خلال توظيف استكشاف موجه بالاستراتيجية ومدفوع بالتنوع لتحسين قدرات الاستنتاج بكفاءة في اختبارات الرياضيات المرجعية دون الاعتماد على الإشراف من قِبل "أوراكل" المكلف أو التوسع بالقوة الغاشمة.

Chanuk Lee, Sangwoo Park, Minki Kang, Sung Ju Hwang2026-05-18
💬 NLP

DimMem: Dimensional Structuring for Efficient Long-Term Agent Memory

تقدم الورقة البحثية DimMem، وهو إطار عمل للذاكرة البعدية خفيف الوزن يعمل على هيكلة ذاكرات الوكلاء في وحدات ذرية محددة النوع ذات حقول صريحة لتحقيق دقة وكفاءة فائقتين في الاسترجاع طويل الأمد مقارنة بالأنظمة الحالية، مع إثبات أن النماذج المدمجة يمكنها تعلم مخطط الاستخراج هذا بفعالية.

Wentao Qiu, Haotian Hu, Fanyi Wang, Jinwei Kong, Yu Zhang2026-05-18
💬 NLP

Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination

تكشف هذه الورقة أن نماذج الرؤية واللغة غالباً ما تنتج عبارات تأمل ذاتي مثل "دعني أتحقق مجدداً" كمجرد أنماط نصية بدلاً من تحفيز إعادة فحص بصري حقيقي، وهو استنتاج أثبته إطار عمل VisualSwap الذي يُظهر أن النماذج تفشل تكراراً في اكتشاف عمليات تبديل الصور المختلفة دلالياً رغم مثل هذه الادعاءات.

Chufan Shi, Cheng Yang, Yaokang Wu, Linhao Jin, Bo Shui, Taylor Berg-Kirkpatrick, Xuezhe Ma2026-05-18
💬 NLP

Linked Multi-Model Data on Russian Domestic and Foreign Policy Speeches

تقدم هذه الورقة مجموعة بيانات متعددة الوسائط شاملة ومترابطة لخطابات الحكومة الروسية، تجمع بين النصوص متعددة اللغات، والصور، والتعليقات التوضيحية الموضوعية المعتمدة من قبل خبراء، وذلك لتسهيل أبحاث العلوم الاجتماعية المتقدمة وتطبيقات النماذج اللغوية الكبيرة في دراسة التواصل السياسي الاستبدادي.

Daria Blinova, Gayathri Emuru, Rakesh Emuru, Kushagradheer Shridheer Srivastava, Mina Rulis, Sunita Chandrasekaran, Benj (…)2026-05-18
💬 NLP

Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation

تقدم هذه الورقة البحثية SemanticSeg، وهي مجموعة بيانات واسعة النطاق ونموذج خفيف الوزن لتقسيم النصوص تلقائياً، إلى جانب إطار عمل للتقطير الكتلي يتميز بمكونات مبتكرة مثل رموز الـ block sink ووزن الخسارة على مستوى الـ token، للتغلب على تحديات تقسيم المدخلات وعدم كفاءة التدريب في انتباه الكتل (block attention)، مما يتيح نشره العملي والقابل للتوسع في سيناريوهات السياق الطويل.

Shuaiyi Li, Zhisong Zhang, Yan Wang, Lei Zhu, Dongyang Ma, Chenlong Deng, Yang Deng, Wai Lam2026-05-18
💬 NLP

Reference-Free Reinforcement Learning Fine-Tuning for MT: A Seq2Seq Perspective

تُثبت هذه الورقة أن تحسين السياسة النسبي للمجموعات (GRPO) باستخدام مكافأة هجينة خالية من المراجع يمكنه ضبط نماذج الترجمة الآلية من نوع مشفر-فك تشفير (NLLB-200) بفعالية عبر 13 لغة متنوعة دون الحاجة إلى بيانات متوازية، محققاً مكاسب أداء كبيرة تظهر بوضوح أكبر في سيناريوهات الموارد المنخفضة حيث يكون أداء الخط المرجعي في أضعف حالاته.

Ernesto Garcia-Estrada, Carlos Escolano, José A. R. Fonallosa2026-05-18
💬 NLP

Ontology for Policing: Conceptual Knowledge Learning for Semantic Understanding and Reasoning in Law Enforcement Reports

تقترح هذه الورقة إطار عمل رمزيًا يحول السرديات غير المهيكلة لإنفاذ القانون إلى حقائق مرتبطة بالأدلة ورسوم بيانية زمنية من خلال دمج التحليل الدلالي، ورسم خرائط الأنطولوجيا، والاستنتاج، مما يظهر دقة عالية في استخراج تفاصيل الحوادث الرئيسية من تقارير جرائم الممتلكات.

Anita Srbinovska, Jansen Orfan, Adrian Martin, Ernest Fokoué2026-05-18
💬 NLP

Defining Cultural Capabilities for AI Evaluation: A Taxonomy Grounded in Intercultural Communication Theory

بالاستناد إلى نظرية التواصل بين الثقافات، تقترح هذه الورقة تصنيفاً ثلاثي المستويات للوعي الثقافي، والحساسية الثقافية، والكفاءة الثقافية، وذلك لحل الغموض في أطر تقييم الذكاء الاصطناعي الحالية وضمان تقييمات أكثر صلاحية وقابلية للتفسير لأداء النماذج في السياقات متعددة الثقافات.

Isar Nejadgholi, Masoud Kianpour, Krishnapriya Vishnubhotla, Maryam Molamohamadi2026-05-18
💬 NLP

Can Vision Language Models Be Adaptive in Mathematics Education? A Learner Model-based Rubric Study

تقترح هذه الورقة نموذج تقييم (rubric) قائماً على نموذج المتعلم لتقييم قدرة نماذج الرؤية واللغة (VLMs) على التكيف في تعليم الرياضيات بشكل منهجي، كاشفةً أنه على الرغم من وجود فروق قابلة للقياس بين النماذج، إلا أن نماذج الرؤية واللغة الحالية تواجه صعوبة في توليد استجابات تعليمية مخصصة باستمرار، لا سيما عند تزويدها بمعلومات محدودة عن المتعلم.

Jie Gao, Yongan Yu, Junzhu Su, Yiran Lin, Adam K. Dube, Jackie Chi Kit Cheung2026-05-18
💬 NLP

Judge Circuits

تستخدم هذه الورقة تقنية "ترقيع تخصيص الحواف المدرك للموضع" (Position-aware Edge Attribution Patching) للكشف عن امتلاك النماذج اللغوية الكبيرة لـ "مخطط فرعي للمقيم الكامن" (Latent Evaluator sub-graph) مشترك ومتناثر للقياسات، وهو منفصل بنيوياً عن فروع المخرجات الهشة والمحددة بتنسيق معين، مما يفسر سبب كون موثوقية الاختبارات المعيارية غالباً ما تقيس هندسة التنسيق بدلاً من جودة التقييم الحقيقية.

Nils Feldhus, Tanja Baeumel, Elena Golimblevskaia, Qianli Wang, Van Bach Nguyen, Aaron Louis Eidt, Christopher Ebert, Wo (…)2026-05-18