💬 NLP

STEMMA: An Adversarial Multi-Agent Framework for Evaluating Self-Identity Consistency in LLMs

تقدم هذه الورقة STEMMA، وهو إطار عمل تنافسي متعدد الوكلاء ومجموعة من المطالبات المصممة يدويًا لتقييم اتساق الهوية الذاتية في النماذج اللغوية الكبيرة، كاشفةً أن النماذج الطلابية غالبًا ما ترث أنماطًا سلوكية من النماذج المعلمة تؤدي إلى ثغرات في تمثيلاتها لذاتها.

Nuthakki Siva Gopala Krishna, Kanishka Jain2026-08-11
⚡ electrical engineering

DisMorph\texttt{DisMorph}: learning to disentangle technical distortions from true biological change

تقدم الورقة البحثية DisMorph\texttt{DisMorph}، وهو إطار عمل للتسجيل مدرب على بيانات اصطناعية يعمل على فك الارتباط بين تشوهات الرنين المغناطيسي التقنية والتغيرات البيولوجية الدماغية الحقيقية لتمكين قياس مورفولوجي طولي أكثر دقة في دراسات الأمراض التنكسية العصبية.

Jingru Fu, Kathleen E. Larson, Douglas N. Greve, Bruce Fischl, Malte Hoffmann2026-08-11
💬 NLP

A Grounded and Decomposed Framework for Relation-Level Hallucination Evaluation in Abstractive Summarization

تقدم هذه الورقة إطار عمل يعتمد على التأسيس والوعي بالتبعية لتقييم الهلوسة على مستوى العلاقات في التلخيص التجريدي، ويتميز بخوارزمية استخراج محسنة ومؤشر هلوسة علاقات (RHI) معياري يفكك الأمانة إلى مكونات قابلة للتفسير من أجل تقييم أكثر استقراراً وتمييزاً للنماذج.

Praveen Kumar Katwe, Rakesh Chandra Balabantaray, Kali Prasad Vittala, Naman Kabadi2026-08-11
🤖 AI

Persuasive and Compliant Tendencies Predict Group Decision-Making in Humans and Language Models

تقدم هذه الورقة إطار عمل DecisionQE لتوضيح أنه في حين أن النزعات الإقناعية لا تحسن نتائج المجموعات بشكل ملحوظ، فإن نزعات الامتثال لدى كل من البشر والنماذج اللغوية الكبيرة تعزز التعاون المستقر وتكشف عن أنماط سلوكية متميزة تعد حاسمة لفهم التأثير الاجتماعي وتعزيز تقييمات السلامة.

Wenwen He, Wenke Huang, Wei Yang Bryan Lim, Dacheng Tao2026-08-11
🤖 machine learning

FreSH: Frequency-Segmented Hierarchical Multi-Expert Framework for Multivariate Time Series Classification

تقدم الورقة البحثية FreSH، وهو إطار عمل هرمي متعدد الخبراء ومجزأ ترددياً، يعزز تصنيف السلاسل الزمنية متعددة المتغيرات من خلال الجمع بين التحليل التكيفي متعدد المقاييس والتحسين القوي لتحقيق دقة وكفاءة فائقتين عبر مجموعات بيانات متنوعة.

Pingping Liu, Muyao Wang, Zijian Zhang, Tongshun Zhang, Hao Miao, Guorui Xie, Qingliang Li, Qiuzhan Zhou2026-08-11
🤖 AI

Illusion of Alignment: Detecting Hidden Disagreement in Collaborative Dialogue

تقدم هذه الورقة ظاهرة "وهم التوافق" في الحوار التعاوني، حيث تستمر الخلافات الخفية رغم الإجماع الظاهري، وتقترح إطاراً تشخيصياً ونموذجاً (IoA-Prober-8B) تم تدريبه على مجموعة بيانات IoA-Suite الجديدة للكشف عن هذه الصراعات غير المعلنة، مما يؤدي إلى تحسين نتائج الاجتماعات البشرية وأداء المهام متعددة الوكلاء على حد سواء.

Kaiming Liu, Fuwen Luo, Ziyue Wang, Jinrui Ju, Yuxuan Liu, Xuanyu Lei, Yunghwei Lai, Peng Li, Yang Liu2026-08-11
🤖 AI

Harmful Content Is Not Enough: Continuation Framing Moderates In-Context Emergent Misalignment

تُبين هذه الورقة أنه في حين أن المحتوى الضار ضروري لحدوث عدم المحاذاة الناشئ في سياق الاستخدام، فإن الصياغة المحددة لهذا المحتوى باعتباره استمراراً لسلوك المساعد (بدلاً من مجرد دليل أو مخرجات أداة) هي عامل حاسم يعتمد على النموذج، مما يضاعف بشكل كبير من خطر توليد استجابات ضارة.

Peiyang Liu, Xi Wang, Ziqiang Cui, Di Liang, Wei Ye2026-08-11
💻 computer science

VTO: Visual Tool Orchestration for Video Anomaly Detection

تقترح الورقة البحثية إطار عمل VTO، وهو إطار للتعلم التعزيزي الخاضع للإشراف على العمليات يستفيد من مُقيّم معرفي مدفوع بنموذج تأسيسي وإشراف دقيق خطوة بخطوة لتمكين الوكلاء متعددي الوسائط من تنسيق الأدوات البصرية المتخصصة ديناميكيًا لتحسين كشف الشذوذ في الفيديو، وهو ما تم التحقق منه بواسطة معيار ومجموعة أدوات جديدة تسمى VAD-Tool.

Rui Wang, Yeteng Wu, Xianling Zhang, Mengshi Qi2026-08-11
🤖 AI

Metanormative Theory for RL-Based Moral Agents

تجسّر هذه الورقة الفجوة بين أخلاقيات الآلة والنظرية الميتا-معيارية الفلسفية من خلال تطبيق الأفكار الحديثة المستمدة من الأخيرة على بنيات التعلم المعزز، بهدف وضع معايير أكثر وضوحاً للسلوك الأخلاقي وتحسين تقييم الوكلاء المتوافقين مع القيم.

Aleks Knoks, Marija Slavkovik2026-08-11
🤖 AI

FemWear: A Specialized Wearable Foundation Model for Women's Health

يُعد FemWear نموذجاً تأسيسياً قابلاً للارتداء، متخصصاً وفعالاً من حيث المعلمات، يعيد توظيف عمود فقري متعدد الوسائط مُدرب مسبقاً لتعلم تمثيل طولي مشترك لمختلف نتائج صحة المرأة، مُظهراً تحسينات ملحوظة في مقاييس محددة مثل التنبؤ بمرحلة الدورة الشهرية وتقليل خطأ الأعراض، مع الإقرار بالقيود في الهيمنة الأدائية الشاملة والصلاحية السريرية.

Yifan Wang, Chenzhong Li2026-08-11