💬 NLP

Convergence Without Understanding: When Language Models Agree on Representations but Disagree on Reasoning

تتحدى هذه الورقة البحثية فكرة أن التقارب التمثيلي في النماذج اللغوية الكبيرة ينطوي على استراتيجيات استدلال مشتركة، حيث تكشف أنه بينما تطور النماذج تمثيلات داخلية متشابهة للمدخلات المشتركة، فإنها تظهر انفصالات كبيرة في عمليات الاستدلال، لا سيما فيما يتعلق بصعوبة المشكلات، ومراحل اتخاذ القرار، والتأثير السببي للمعلومات المشتركة.

Muhammad Usama, Dong Eui Chang2026-05-25
💬 NLP

Emotion Recognition in Sign Language Conversation

تتناول هذه الورقة نقص السياق الحواري في التعرف على العواطف في لغة الإشارة من خلال تقديم مجموعة بيانات eJSL Dialog، وإثبات أن النماذج العامة الحالية تعاني من فجوة نطاق من خلال التقييم المرجعي المنهجي، مما يسلط الضوء على الحاجة إلى مستخلصات بصرية مدركة للسياق ومجموعات بيانات أكبر نطاقاً للأبحاث المستقبلية.

Yusong Wang, Keyu Mao, Takao Obi, Minghao Shao, Kotaro Funakoshi2026-05-25
💬 NLP

From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning

تقترح هذه الورقة إطار عمل موحداً لتعلم تعزيزي وكيلِيّ مخصص يدمج بين تحسين السياسة بفك الارتباط بمكافأة المرساة المخصصة (PARPO)، ونموذج مكافأة مفكك التفضيلات، وذاكرة رسم بياني لتطور المهارات المتوافقة مع التفضيلات (PSGM)، وذلك لمعالجة تفضيلات المستخدمين غير المتجانسة بفعالية وتحسين أداء الوكيل عبر سيناريوهات التخطيط واستخدام الأدوات المتنوعة.

Ranxu zhang, zeyang li, Jiacheng Huang, Rui Zhang, Xiaozhou Xu, sun zhe, Yanyong Zhang, Chao Wang2026-05-25✓ Author reviewed
💬 NLP

Articulatory strategy as a source of variation in acoustic vowel dynamics

تستخدم هذه الدراسة تصوير اللسان بالموجات فوق الصوتية لـ 36 متحدثاً بالإنجليزية من شمال إنجلترا لتوضيح أن الاستراتيجيات النطقية الفردية المتميزة لإنتاج المصوت /i/ تتنبأ بشكل منهجي بديناميكيات الترددات الصيغية في الأصوات المزدوجة، مما يربط بين حركات لسان محددة والتباين الصوتي والفردية لدى المتحدث.

Patrycja Strycharczuk, Justin J. H. Lo, Sam Kirkham2026-05-25
💬 NLP

SSDAU: Structured Semantic Data Augmentation for Joint Entity and Relation Extraction

تقترح هذه الورقة البحثية طريقة SSDAU، وهي طريقة مبتكرة لتعزيز البيانات تحافظ على البنية الدلالية من خلال التجزئة القائمة على الكيانات، وإعادة الهيكلة المدركة للسياق، وتصفية المواضيع، وذلك لتحسين قدرة نماذج استخراج الكيانات والعلاقات المشتركة على التعميم والمتانة بشكل كبير ضد بيانات التدريب الضعيفة.

Jiawei He, Mengyu Shi, Chunrong Fang2026-05-25
💬 NLP

ARES: Automated Rubric Synthesis for Scalable LLM Reinforcement Learning

تقدم الورقة البحثية ARES، وهو إطار عمل يقوم تلقائياً بتخليق بيانات تدريب قائمة على معايير تقييم (rubric) ضخمة ومحددة لكل حالة من الوثائق الخام لتعزيز أداء التعلم التعزيزي في النماذج اللغوية الكبيرة بشكل كبير، لا سيما للمهام المفتوحة المعقدة ومتعددة الأبعاد.

Xiaoyuan Li, Keqin Bao, Moxin Li, Yubo Ma, Yichang Zhang, Wenjie Wang, Fuli Feng, Dayiheng Liu2026-05-25
💬 NLP

Asking For An Old Friend: Diagnosing and Mitigating Temporal Failure Modes in LLM-based Statutory Question Answering

تقدم هذه الورقة معياراً مرجعياً للإجابة على الأسئلة القانونية الألمانية الحساسة للوقت، وتُبين أنه في حين أن التوليد المعزز بالاسترجاع مع التصفية الزمنية يحد بفعالية من تقادم ما بعد تاريخ قطع البيانات وانحياز الحداثة في النماذج اللغوية الكبيرة القانونية، فإن النماذج التقليدية ونهج البحث عبر الويب تعاني من إخفاقات زمنية شديدة، مما يسلط الض {الضوء} على ضرورة فرض الصلاحية الزمنية كقيد صارم لضمان موثوقية الذكاء الاصطناعي القانوني.

Max Prior, Andreas Schultz, Matthias Grabmair2026-05-25
💬 NLP

Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts

تقدم هذه الورقة البحثية "حل الكيانات الموجه بالبنية" (SGER)، وهو إطار عمل للضبط الدقيق المنهجي ثنائي المراحل للنماذج اللغوية الكبيرة، والذي يحقق دقة هي الأفضل في مجال مطابقة الأسماء الشخصية المعقدة ومتعددة اللغات، ويتم نشره حالياً على نطاق واسع لامتثال "اعرف عميلك" (KYC) على منصة Dream11.

Shivam Chourasia, Hitesh Kapoor, Nilesh Patil2026-05-25
💬 NLP

DiLaDiff: Distilled Latent-Augmented Diffusion for Language Modeling

يعالج DiLaDiff المقايضة بين جودة أخذ العينات والإنتاجية في نماذج الانتشار اللغوية من خلال تقديم إطار عمل ثلاثي المراحل يستخدم فضاءً كامناً دلالياً، ونموذج انتشار كامن مسبق، وتقطير الاتساق لتحقيق توليد عالي الجودة وبخطوات قليلة يتفوق بشكل كبير على النماذج المرجعية للانتشار المقنع.

Jean-Marie Lemercier, Tomas Geffner, Karsten Kreis, Morteza Mardani, Arash Vahdat, Ante Jukić2026-05-25
💬 NLP

How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework

تقدم هذه الورقة إطار تقييم مدركاً للسجل اللغوي باستخدام تباين المتوسط الأقصى (Maximum Mean Discrepancy) وميزات "بيبر" (Biber) المعجمية-النحوية لإثبات أنه في حين تنحرف النماذج اللغوية الكبيرة باستمرار عن الأنماط اللغوية البشرية، فإن درجة تشبهها بالبشر تختلف باختلاف السجل التواصلي ولا تتحدد بحجم النموذج.

Björn Nieth (Department Artificial Intelligence in Biomedical Engineering, Chair of AI-supported Therapy Decisions LMU M (…)2026-05-25