🤖 machine learning

CoVerRL: Breaking the Consensus Trap in Label-Free Reasoning via Generator-Verifier Co-Evolution

يُعد CoVerRL إطار عمل للتعلم التعزيزي الخالي من الملصقات، وهو يمنع "فخ الإجماع" المتمثل في انهيار الاستدلال من خلال تمكين نموذج واحد من التطور المشترك كـمُوَلِّد ومُحقِّق في آن واحد، مما يحافظ على دقة عالية للمكافأة ويتفوق بشكل كبير على النماذج المرجعية الحالية في اختبارات معايير الاستدلال الرياضي.

Teng Pan, Yuchen Yan, Zixuan Wang, Ruiqing Zhang, Gaiyang Han, Wanqi Zhang, Weiming Lu, Jun Xiao, Yongliang Shen2026-03-19
💬 NLP

CodeScout: An Effective Recipe for Reinforcement Learning of Code Search Agents

تقدم الورقة البحثية CodeScout، وهو إطار عمل للتعلم التعزيزي يدرب وكلاء البرمجة باستخدام محطة طرفية (Unix terminal) قياسية فقط لتحقيق أداء متفوق أو تنافسي في تحديد موقع الكود عبر عدة معايير، متفوقاً بذلك على نماذج أكبر بكثير دون الاعتماد على أدوات متخصصة معقدة.

Lintang Sutawika, Aditya Bharat Soni, Bharath Sriraam R R, Apurva Gandhi, Taha Yassine, Sanidhya Vijayvargiya, Yuchen Li (…)2026-03-19
🤖 machine learning

Text-to-Stage: Spatial Layouts from Long-form Narratives

تقدم هذه الورقة البحثية "Text-to-Stage"، وهي طريقة تستفيد من الجمع بين الضبط الدقيق بأسلوب الرفض (rejection SFT) مع أخذ عينات من أفضل N (Best-of-N sampling) والتعلم التعزيزي القائم على خوارزمية GRPO لتمكين النماذج اللغوية من استنتاج تخطيطات مسرحية مكانية معقدة من سرديات طويلة غير منظمة، مما يظهر تحسينات كبيرة في الاستدلال المكاني والتوافق مع التفضيلات البشرية مقارنة بالنماذج المرجعية.

Jefferson Hernandez, Swarnadeep Saha, Chenxi Whitehouse, Sanjeel Parekh, Calvin Murdock, Yuliang Li, W. Owen Brimijoin (…)2026-03-19
🤖 machine learning

How do LLMs Compute Verbal Confidence

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة مثل Gemma 3 وQwen 2.5 تقوم تلقائياً بحساب وتخزين تمثيلات ثقة متطورة قائمة على جودة الإجابة أثناء عملية التوليد بدلاً من حسابها آنياً، مما يكشف أن الثقة اللفظية تعكس تقييماً ذاتياً معرفياً حقيقياً وليس مجرد إعادة بناء لاحقة لاحتمالات الرموز.

Dharshan Kumaran, Arthur Conmy, Federico Barbero, Simon Osindero, Viorica Patraucean, Petar Velickovic2026-03-19
💬 NLP

DebugLM: Learning Traceable Training Data Provenance for LLMs

يُعد DebugLM إطار عمل يزود النماذج اللغوية الكبيرة بقدرات مدمجة لتتبع أصل البيانات، مما يتيح تتبع سلوكيات محددة وصولاً إلى مصادر بيانات تدريبها وتمكين المعالجة المستهدفة دون الحاجة لإعادة التدريب وبدون تغيير المعلمات.

Wenjie Jacky Mo, Qin Liu, Xiaofei Wen, Wenxuan Zhou, Zhe Zhao, Muhao Chen2026-03-19
💬 NLP

IndicSafe: A Benchmark for Evaluating Multilingual LLM Safety in South Asia

تقدم هذه الورقة IndicSafe، وهو أول معيار لتقييم سلامة النماذج اللغوية الكبيرة عبر 12 لغة هندية، كاشفةً عن انحراف كبير في السلامة عبر اللغات وفجوات في التعميم تستوجب استراتيجيات محاذاة مدركة للغة في البيئات متنوعة ثقافياً ومنخفضة الموارد.

Priyaranjan Pattnayak, Sanchari Chowdhuri2026-03-19
💬 NLP

Efficient Training-Free Multi-Token Prediction via Embedding-Space Probing

تقترح هذه الورقة طريقة للتنبؤ متعدد الرموز لا تتطلب تدريباً، تستفيد من سبر رموز القناع في فضاء التضمين أثناء التشغيل لتمكين فك التشفير التخميني المتوازي، مما يحقق مكاسب كبيرة في معدل الإنتاجية وزيادة في أطوال القبول عبر مختلف النماذج اللغوية الكبيرة دون تعديل أوزان النموذج أو الحاجة إلى نماذج مسودة إضافية.

Raghavv Goel, Mukul Gagrani, Mingu Lee, Chris Lott2026-03-19
💬 NLP

Gender Disambiguation in Machine Translation: Diagnostic Evaluation in Decoder-Only Architectures

تقدم هذه الورقة مقياس "التحيز المسبق" لتقييم فض الاشتباك بين الجنسين في نماذج الترجمة الآلية ذات فك التشفير فقط، كاشفةً أنه بينما لا تتفوق هذه النماذج بطبيعتها على بنيات الترميز وفك التشفين، فإن تقنيات ما بعد التدريب مثل الضبط الدقيق للتعليمات تعمل بفعالية على تقليل التحيز المذكر وتعزيز الوعي السياقي.

Chiara Manna, Hosein Mohebbi, Afra Alishahi, Frédéric Blain, Eva Vanmassenhove2026-03-19
💬 NLP

ConGA: Guidelines for Contextual Gender Annotation. A Framework for Annotating Gender in Machine Translation

تقدم هذه الورقة إطار عمل "الوسم الجندري السياقي" (ConGA)، وهو دليل يستند إلى أسس لغوية للوسم الجندري على مستوى الكلمة، يعالج التحيز الجندري في الترجمة الآلية من الإنجليزية إلى الإيطالية عبر إنشاء مجموعة بيانات معيارية لتقييم وتحسين أداء أنظمة الترجمة الآلية الحالية.

Argentina Anna Rescigno, Eva Vanmassenhove, Johanna Monti2026-03-19
💬 NLP

Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models

يُعد Loc3R-VLM إطار عمل مبتكر يعزز نماذج الرؤية واللغة ثنائية الأبعاد بقدرات فهم ثلاثية الأبعاد قوية من مقاطع الفيديو أحادية العدسة، وذلك عبر الاستفادة من أهداف مشتركة لإعادة بناء المخطط العام ونمذجة الموقف الصريحة، بتوجيه من أولويات وضع الكاميرا خفيفة الوزن لتحقيق أداء رائد في التحديد المكاني القائم على اللغة والاستدلال ثلاثي الأبعاد.

Kevin Qu, Haozhe Qi, Mihai Dusmanu, Mahdi Rad, Rui Wang, Marc Pollefeys2026-03-19