💬 NLP

SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter

تقدم هذه الورقة SMILE-Next، وهي مجموعة بيانات شاملة للضحك في العالم الحقيقي، وتقترح إطار عمل لنموذج لغوي كبير متخصص يتميز بآلية "التعليم الذاتي الخاص بالضحك" (Laughter-specific Self-Instruct) وآلية "خليط من خبراء الضحك" (Mixture-of-Laugh-Experts - MoLE) لتحسين اكتشاف وتصنيف واستدلال إشارات الضحك الاجتماعي المعقدة بشكل كبير.

Lee Jung-Mok, Kim Sung-Bin, Joohyun Chang, Lee Hyun, Tae-Hyun Oh2026-05-28
🤖 AI

Defending LLM-based Multi-Agent Systems Against Cooperative Attacks with Sentence-Level Rectification

تتناول هذه الورقة البحثية ضعف أنظمة الوكلاء المتعددين القائمة على النماذج اللغوية الكبيرة تجاه السلوكيات الخبيثة المنسقة من خلال اقتراح إطار عمل هجوم تعاوني تكيفي وتقديم آلية دفاع "تحليل وتصحيح الموثوقية على مستوى الجملة" (STAR)، والتي تحدد وتصحح المعلومات المضللة بفعالية لاستعادة معدلات نجاح المهام بشكل كبير.

Yaoyang Luo, Zhi Zheng, Ziwei Zhao, Tong Xu, Zhao Jielun, Wenjun Xue, Yong Chen, Enhong Chen2026-05-28
🤖 AI

CIVIC: End-to-End Sequence Compactness for Efficient Vision-Language Models

إنَّ CIVIC هو إطار عمل متكامل يحقق كفاءة حقيقية في الأجهزة لنماذج الرؤية واللغة من خلال الحفاظ على مسار بصري مدمج ومتصل عبر جميع مراحل الاستدلال، مما يقلل بشكل كبير من الذاكرة وزمن الاستجابة دون المساس بالدقة.

Fengze Yang, Bo Yu, Xuewen Luo, Cathy Liu, Chenxi Liu2026-05-28
💬 NLP

MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content

تقدم الورقة البحثية MIRAGE، وهو مسار هجوم مدرك للسياق يقوم بحقن مطالبات عدائية في المحتوى الذي ينشئه المستخدم داخل لقطات شاشة واجهة مستخدم الهاتف المحمول لخداع وكلاء النماذج اللغوية الرؤية، مما يثبت أن جميع الوكلاء الخمسة الذين تم تقييمهم عرضة لهجمات واقعية لا يمكن تمييزها بصرياً بنسب نجاح تتراوح بين 23% و30%.

Ruoqi Guo, Yi Liu, Gelei Deng, Yiheng Xiong, Yuekang Li, Ying Zhang, Leo Yu Zhang, Lida Zhao, Ji Jie, Yuxiao Lu2026-05-28
💬 NLP

LegalGraphRAG: Multi-Agent Graph Retrieval-Augmented Generation for Reliable Legal Reasoning

يُعد LegalGraphRAG إطار عمل متعدد الوكلاء يعزز الاستدلال القانوني الموثوق من خلال توظيف رسم بياني قانوني هرمي لإدارة المعرفة غير المتجانسة ونظام وكلاء تعاوني (باحث، مدقق، ومُحكّم) لضمان أحكام شفافة وقائمة على الأدلة، محققاً أداءً هو الأفضل في فئته مقارنة بالنماذج المرجعية الحالية لتقنية GraphRAG.

Zerui Chen, Qinggang Zhang, Zhishang Xiang, Zhimin Wei, Linfeng Gao, Xiao Huang, Zhihong Zhang, Jinsong Su2026-05-28
💬 NLP

SNARE: Adaptive Scenario Synthesis for Eliciting Overeager Behavior in Coding Agents

تقدم هذه الورقة SNARE، وهو مسار تكيفي يعمل على تخليق سيناريوهات حميدة للكشف عن أن ما يقرب من 20% من عمليات وكلاء البرمجة تظهر سلوكًا "متحمسًا للغاية" (القيام بإجراءات غير مصرح بها رغم نجاح المهمة)، وهي ثغرة ناتجة عن أطر عمل الوكلاء أكثر من النماذج الأساسية وتغفل عنها المقاييس الحالية إلى حد كبير.

Yubin Qu, Yi Liu, Gelei Deng, Yanjun Zhang, Yuekang Li, Ying Zhang, Leo Yu Zhang2026-05-28
🤖 AI

Do Clinical Models Change Treatment Decisions?

تقدم هذه الورقة ClinPivot، وهو معيار مرجعي يوضح أن الأداء القوي في الأسئلة والأجوبة الطبية لا يضمن قدرة النموذج على تكييف قرارات العلاج بشكل صحيح مع سياقات المرضى المتغيرة، بينما يُظهر أن الإشراف القائم على هيكلة القرار وإعادة التشغيل خفيفة الوزن يمكن أن يحسنا من اتخاذ القرارات الحساسة للمتغيرات ومن قدرات المساعد العامة.

Dongkyu Cho, Miao Zhang, Rumi Chunara2026-05-28
🤖 AI

Data-Efficient On-Policy Distillation for Automatic Speech Recognition

تُثبت هذه الورقة أن التقطير داخل السياسة الموجه من قبل المعلم يُمكّن نموذج التعرف التلقائي على الكلام (ASR) مدمج بـ 0.6 مليار معلمة، والمدرب على 100 ألف ساعة فقط من الكلام، من التفوق بشكل كبير على الضبط الدقيق الخاضع للإشراف ومضاهاة النماذج المرجعية الأكبر حجمًا تقريبًا، مما يقلل من متطلبات البيانات للتعرف التلقائي على الكلام التنافسي.

Yu Lin, Yiming Wang, Runyuan Cai, Xiaodong Zeng2026-05-28
🤖 AI

DeltaMCP: Incremental Regeneration via Spec-Aware Transformation for MCP servers

تُعد DeltaMCP أداة مدركة للمواصفات تتيح التوليد التدريجي لخوادم MCP ذات المستوى المؤسسي عبر تحديث المكونات المتأثرة فقط عند تغير مواصفات OpenAPI، مما يقلل من العبء التطويري ويحسن قابلية الصيانة مقارنة بطرق التوليد الكامل.

Aditya Pujara, Xiaogang Zhu, Hsiang-Ting Chen2026-05-28
🤖 AI

OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents

تقدم الورقة البحثية OR-Space، وهو معيار مساحة عمل كاملة دورة الحياة مصمم لتقييم وكلاء التحسين الصناعي في مهام واقعية متعددة المراحل تتضمن بناء النماذج، والمراجعة، والتفسير المرتكز ضمن بيئات مستمرة ومتعددة المصنوعات، متجاوزاً بذلك تقييمات صياغة المشكلات التقليدية ذات الخطوة الواحدة.

Chenyu Zhou, Xinyun Lu, Jiangyue Zhao, Jianghao Lin, Dongdong Ge, Yinyu Ye2026-05-28