🤖 AI

SWE-AGILE: A Software Agent Framework for Efficiently Managing Dynamic Reasoning Context

يُعد SWE-AGILE إطار عمل لوكيل برمجيات مبتكر يعالج المقايضة بين عمق الاستدلال وحدود السياق في هندسة البرمجيات المستقلة من خلال توظيف استراتيجية ديناميكية تحافظ على نافذة منزلقة من الاستدلال التفصيلي مع ضغط السياق التاريخي إلى ملخصات موجزة، مما يحقق أداءً رائدًا في SWE-Bench-Verified باستخدام نماذج 7B-8B فعالة.

Shuquan Lian, Juncheng Liu, Yazhe Chen, Yuhong Chen, Hui Li2026-04-14
💬 NLP

Evaluating Cooperation in LLM Social Groups through Elected Leadership

تقدم هذه الورقة إطار عمل مفتوح المصدر لمحاكاة القيادة المنتخبة في أنظمة الوكلاء المتعددين القائمة على النماذج اللغوية الكبيرة، وتثبت من خلال دراسة تجريبية أن هياكل الحوكمة هذه تعزز بشكل كبير الرفاه الاجتماعي ووقت البقاء مقارنة بالتعاون غير المنظم.

Ryan Faulkner, Anushka Deshpande, David Guzman Piedrahita, Joel Z. Leibo, Zhijing Jin2026-04-14
💬 NLP

Discourse Diversity in Multi-Turn Empathic Dialogue

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تظهر جموداً مفرطاً في إعادة استخدام الحركات الخطابية خلال المحادثات التعاطفية متعددة الأدوار، وتقترح MINT، وهو إطار عمل للتعلم المعزز يعمل على تحسين الجدة التكتيكية عبر الأدوار بشكل كبير، مما يؤدي إلى تحسين كل من تنوع الخطاب وجودة التعاطف الإجمالية.

Hongli Zhan, Emma S. Gueorguieva, Javier Hernandez, Jina Suh, Desmond C. Ong, Junyi Jessy Li2026-04-14
💬 NLP

LangFlow: Continuous Diffusion Rivals Discrete in Language Modeling

يقدم Logflow نموذج لغة انتشار مستمر مبتكر يسد فجوة الأداء مع النماذج المنفصلة من خلال الاستفادة من مطابقة التدفق عبر تباعد بريجمان، ومجدول ضوضاء قابل للتعلم قائم على توزيع غامبل، وبروتوكول تدريب محسّن، محققاً درجات تنافسية في الارتباك ومتفوقاً على النماذج ذات الترتيب الذاتي في نقل القدرات الصفري.

Yuxin Chen, Chumeng Liang, Hangke Sui, Ruihan Guo, Chaoran Cheng, Jiaxuan You, Ge Liu2026-04-14
🤖 machine learning

ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents

تقدم الورقة البحثية ClawGUI، وهو إطار عمل مفتوح المصدر يوحد تدريب وتقييم ونشر وكلاء واجهات المستخدم الرسومية (GUI) من خلال توفير بنية تحتية مستقرة للتعلم التعزيزي (RL) للأجهزة الافتراضية والمادية، ومسار قياس معياري، ونشر الوكلاء عبر المنصات، مما مكن في النهاية نموذج ClawGUI-2B من التفوق على النماذج المرجعية الحالية في مهام واجهة المستخدم الرسومية للهواتف المحمولة.

Fei Tang, Zhiqiong Lu, Boxuan Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen2026-04-14
💬 NLP

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation

تقدم الورقة البحثية CLSGen، وهو إطار عمل جديد للضبط الدقيق ثنائي الرأس يُمكّن النماذج اللغوية الكبيرة من توليد احتمالات كمية موثوقة للتصنيف الثنائي مع الحفاظ على قدرتها على إنتاج تفسيرات لفظية متماسكة، مما يتغلب على قيود النسيان الكارثي والانهيار اللغوي الموجودة في النهج التمييزية التقليدية.

WonJin Yoon, Kangyu Zhu, Ian Bulovic, Autumn Sehy, Yanjun Gao, Dmitriy Dligach, Majid Afshar, Timothy A. Miller2026-04-14
💬 NLP

Saar-Voice: A Multi-Speaker Saarbrücken Dialect Speech Corpus

تقدم هذه الورقة البحثية "Saar-Voice"، وهي عبارة عن متن صوتي للغة الألمانية بلهجة "ساربروكين" مدته ست ساعات، يتميز بنصوص وصوت متوافقين من تسعة متحدثين، صُمم لمعالجة نقص تمثيل اللهجات في معالجة اللغات الطبيعية ودعم الأبحاث المستقبلية في أنظمة تحويل النص إلى كلام المعتمدة على اللهجات والمنخفضة الموارد.

Lena S. Oberkircher, Jesujoba O. Alabi, Dietrich Klakow, Jürgen Trouvain2026-04-14
🤖 AI

Detecting Safety Violations Across Many Agent Traces

تقدم الورقة البحثية Meerkat، وهو نظام مبتكر يجمع بين التجميع والبحث الوكيل (agentic search) للكشف بكفاءة عن انتهاكات السلامة النادرة والمعقدة عبر مجموعات كبيرة من آثار الوكلاء، متفوقاً بشكل كبير على النماذج المرجعية الحالية في تحديد سوء الاستخدام، واختراق المكافأة، وغش المطورين دون الاعتماد على سيناريوهات بذرية أو تعداد شامل.

Adam Stein, Davis Brown, Hamed Hassani, Mayur Naik, Eric Wong2026-04-14
💬 NLP

Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution

تتحدى هذه الورقة البحثية القيود المفروضة على عزو المفاهيم إلى العصبونات بشكل منفصل والناجمة عن تعدد الدلالات في النماذج اللغوية الكبيرة عبر اقتراح "NeuronLens"، وهو إطار عمل يحقق قدرة أكبر على التفسير والدقة في التلاعب المستهدف من خلال تحليل والتدخل في نطاقات تنشيط محددة للمفاهيم بدلاً من العصبونات الفردية.

Muhammad Umair Haider, Hammad Rizwan, Hassan Sajjad, Peizhong Ju, A. B. Siddique2026-04-13
💻 computer science

Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration

تقدم هذه الورقة إطار عمل معايرة الانتباه المدرك للثقة (CAAC)، وهو طريقة خالية من التدريب تعمل على الحد من الهلوسة في النماذج اللغوية البصرية الكبيرة من خلال تصحيح الإدراك المكاني وتحيزات الأنماط عبر معايرة الرموز البصرية وإعادة قياس الانتباه التكيفي، مما يحسن الدقة بشكل كبير في مهام التوليد طويل الأمد.

Mehrdad Fazli, Bowen Wei, Ahmet Sari, Ziwei Zhu2026-04-13