💬 NLP

PAVE: A Cognitive Architecture for Legitimate Violation in Generative Agent Societies

تقدم هذه الورقة PAVE، وهي بنية معرفية مبتكرة رباعية النماذج تمكن الوكلاء التوليديين من اتخاذ قرارات مهيكلة، وقابلة للتفسير، ومعقولة لانتهاك القواعد بشكل مشروع فقط عندما تقتضي الضرورة القصوى ذلك عبر محفزات الطوارئ، مع الحفاظ على الامتثال للسلطة والنطاق المحدود.

Ahmad Yehia, Abduallah Mohamed, Kun Qian, Tianyi Wang, Jiseop Byeon, Omar Hassanin, Christian Claudel2026-05-20
💬 NLP

LambdaPO: A Lambda Style Policy Optimization for Reasoning Language Models

يقدم LambdaPO إطار عمل جديد للتعلم التعزيزي لنماذج اللغة القائمة على الاستدلال، يستبدل خط الأساس لمتوسط المجموعة المتجانس في GRPO بهيكل تفضيل ثنائي ومكافآت الكثافة الدلالية لالتقاط إشارات تحسين دقيقة وتحسين الأداء في المهام المعقدة.

Zhe Yuan, Yipeng Zhou, Jinghan Li, Xinyuan Chen, Bowen Deng, Zhiqian Chen, Liang Zhao2026-05-20
💬 NLP

CEPO: RLVR Self-Distillation using Contrastive Evidence Policy Optimization

تقدم الورقة البحثية تحسين سياسة الأدلة التباينية (CEPO)، وهي طريقة جديدة للتقطير الذاتي في التعلم المعزز من التغذية الراجعة عبر النماذج اللغوية (RLVR) تستفيد من كل من المخرجات الصحيحة والمرفوضة لتوليد إشارة مكافأة تباينية، مما يحدد بدقة خطوات الاستدلال الحاسمة مع تجنب تسرب المعلومات والتفوق على النماذج المرجعية الحالية مثل GRPO في معايير الاستدلال الرياضي متعدد الوسائط.

Ahmed Heakl, Abdelrahman M. Shaker, Youssef Mohamed, Rania Elbadry, Omar Fetouh, Fahad Shahbaz Khan, Salman Khan2026-05-20
💬 NLP

Drifting Objectives for Refining Discrete Diffusion Language Models

تقدم هذه الورقة TokenDrift، وهو هدف تدريب مبتكر يطوع مبادئ الانجراف المستمر لنماذج اللغة ذات الانتشار المنفصل عبر رفع التنبؤات الفئوية إلى سمات الرموز الناعمة من أجل صقل غير متماثل، مما يحسن جودة التوليد بشكل كبير عند خطوات أخذ العينات المنخفضة.

Daisuke Oba, Hiroki Furuta, Naoaki Okazaki2026-05-20
💬 NLP

GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment

يُعد GoLongRL إطار عمل مفتوح المصدر يعزز التعلم المعزز للسياقات الطويلة من خلال مجموعة بيانات موجهة نحو القدرات تضم 23 ألف عينة متنوعة من التعلم المعزز من التغذية الراجعة البشرية (RLVR) وخوارزمية TMN-Reweight المبتكرة لتحسين المهام المتعددة غير المتجانسة، محققاً أداءً يضاهي النماذج الرائدة مغلقة المصدر.

Minxuan Lv, Tiehua Mei, Tanlong Du, Junmin Chen, Zhenpeng Su, Ziyang Chen, Ziqi Wang, Zhennan Wu, Ruotong Pan, jian Lian (…)2026-05-20
💬 NLP

LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening

تقدم هذه الورقة LLMEval-Logic، وهو معيار صيني للتحقق من الاستدلال المنطقي تم التحقق منه بدقة، والذي يستخدم التدقيق الخبير، والتحقق الرسمي باستخدام Z3، والتقوية العدائية للكشف عن فجوات أداء كبيرة في النماذج اللغوية الكبيرة الرائدة الحالية.

Ming Zhang, Qiyuan Peng, Yinxi Wei, Yujiong Shen, Kexin Tan, Yuhui Wang, Zhenghao Xiang, Junjie Ye, Zhangyue Yin, Zhihen (…)2026-05-20
💬 NLP

optimize_anything: A Universal API for Optimizing any Text Parameter

تقدم الورقة البحثية "optimize_anything"، وهو إطار عمل عالمي للتحسين يعتمد على النماذج اللغوية الكبيرة (LLM) ويحقق نتائج رائدة في ستة مجالات متنوعة — بما في ذلك تصميم بنية الوكلاء، وخفض تكاليف السحابة، وتوليد نوى CUDA — من خلال توحيد البحث القائم على النصوص مع نقل المهام المتعددة والمعلومات الجانبية القابلة للتنفيذ للتفوق على الخوارزميات المتخصصة.

Lakshya A Agrawal, Donghyun Lee, Shangyin Tan, Wenjie Ma, Karim Elmaaroufi, Rohit Sandadi, Sanjit A. Seshia, Koushik Sen (…)2026-05-20
💬 NLP

CAIT: A Syntactic Parsing Toolkit for Child-Adult InTeractions

تقدم هذه الورقة البحثية CAIT، وهي مجموعة أدوات مفتوحة المصدر تتميز بمحلل تبعية متخصص، وموسم أجزاء الكلام، وموسم بنى لغوية تم تدريبها على مدونة UD-English-CHILDES لتتفوق على المحللات اللغوية الإنجليزية الحالية في تحليل البنى النحوية ضمن التفاعلات بين الطفل والبالغ في أبحاث اكتساب اللغة.

Francesca Padovani, Xiulin Yang, Bastian Bunzeck, Jaap Jumelet, Yevgen Matusevych, Nathan Schneider, Arianna Bisazza2026-05-20
💬 NLP

TERGAD: Structure-Aware Text-Enhanced Representations for Graph Anomaly Detection

يُعد TERGAD إطار عمل مبتكرًا للكشف عن الشذوذ في الرسوم البيانية، حيث يستفيد من النماذج اللغوية الكبيرة لترجمة الخصائص الطوبولوجية للعقد إلى سرديات دلالية، والتي يتم دمجها بعد ذلك مع السمات الأصلية عبر مشفر تلقائي ثنائي الفروع ذي بوابة لتحديد حالات الشذوذ الناشئة عن عدم الاتساق بين محتوى العقدة ودورها الهيكلي بشكل فعال.

Wen Shi, Zhe Wang, Huafei Huang, Qing Qing, Ziqi Xu, Qixin Zhang, Xikun Zhang, Renqiang Luo, Feng Xia2026-05-20
🤖 AI

What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code

تتحدى هذه الورقة البحثية المفهوم القائل بأن الكود القابل للتنفيذ يعزز الاستدلال العام بطبيعته، حيث تثبت بدلاً من ذلك أن إشارات الاستدلال المهيكلة ضمن البيانات المختلطة من الكود والنصوص والرياضيات والنصوص هي التي تقود التحسينات في الاستدلال الرياضي، مع تقديم استراتيجية للتخفيف من حدة المقايضات بين المجالات المختلفة.

Yuze Zhao, Junpeng Fang, Lu Yu, Zhenya Huang, Kai Zhang, Qing Cui, Qi Liu, Jun Zhou, Enhong Chen2026-05-20