💬 NLP

Semantic Communities and Boundary-Spanning Lyrics in K-pop: A Graph-Based Unsupervised Analysis

تقدم هذه الورقة إطار عمل غير مُتحيز للغة، وقائم على الرسوم البيانية وغير مُوجه، يحلل كلمات أغاني الكيبوب لتحديد المجتمعات الدلالية المستقرة والأغاني العابرة للحدود، كاشفاً أن الترابط عبر المواضيع مدفوع بالتنوع اللفظي بدلاً من التكرار.

Oktay Karakuş2026-02-16
💬 NLP

ViMedCSS: A Vietnamese Medical Code-Switching Speech Dataset & Benchmark

تقدم هذه الورقة ViMedCSS، وهي أول مجموعة بيانات ومعيار لخطاب التبديل اللغوي الطبي باللغة الفيتنامية مدته 34 ساعة، والتي تثبت أن الجمع بين النماذج المحسنة للغة الفيتنامية والتدريب المسبق متعدد اللغات يعد النهج الأكثر فعالية للتعرف على المصطلحات الطبية الإنجليزية داخل الكلام الفيتنامي.

Tung X. Nguyen, Nhu Vo, Giang-Son Nguyen, Duy Mai Hoang, Chien Dinh Huynh, Inigo Jauregi Unanue, Massimo Piccardi, Wray (…)2026-02-16
💬 NLP

RGAlign-Rec: Ranking-Guided Alignment for Latent Query Reasoning in Recommendation Systems

تقترح الورقة البحثية إطار عمل RGAlign-Rec، وهو إطار عمل مغلق الحلقة يدمج مبرهناً دلالياً قائماً على النماذج اللغوية الكبيرة مع نموذج ترتيب من خلال نموذج تدريب مبتكر يعتمد على "المحاذاة الموجهة بالترتيب" لسد الفجوة الدلالية ومحاذاة الاستدلال مع أهداف الترتيب، مما يؤدي إلى تحسين كبير في التنبؤ الاستباقي بالنوايا وأداء التوصية في أنظمة التجارة الإلكترونية الصناعية.

Junhua Liu, Yang Jihao, Cheng Chang, Kunrong LI, Bin Fu, Kwan Hui Lim2026-02-16
💬 NLP

Evaluating the Homogeneity of Keyphrase Prediction Models

تقدم هذه الورقة طريقة لتقييم تجانس نماذج التنبؤ بالكلمات المفتاحية وتكشف أنه، على عكس المتوقع، فإن القدرة على توليد كلمات مفتاحية غائبة لا تحسن التجانس بل يمكن أن تؤثر عليه سلباً، مع إثبات أن طرق الاستخراج تظل منافسة للنماذج التوليدية.

Maël Houbre, Florian Boudin, Beatrice Daille2026-02-16
💬 NLP

TraceBack: Multi-Agent Decomposition for Fine-Grained Table Attribution

يقدم هذا البحث TraceBack، وهو إطار عمل متعدد الوكلاء يعزز الشفافية في الإجابة على الأسئلة القائمة على الجداول من خلال توفير عزو دقيق على مستوى الخلايا للإجابات، مصحوباً بمعيار CITEBench ومقياس FairScore الذي لا يعتمد على المراجع للتقييم المنهجي.

Tejas Anvekar, Junha Park, Rajat Jha, Devanshu Gupta, Poojah Ganesan, Puneeth Mathur, Vivek Gupta2026-02-16
💬 NLP

When a Man Says He Is Pregnant: Event-related Potential Evidence for a Rational Account of Speaker-contextualized Language Comprehension

تُظهر هذه الدراسة المعتمدة على تخطيط كهربية الدماغ أن عدم التطابق بين المتحدث والمحتوى يستثير أنماطًا متميزة من الاستجابات المرتبطة بالجهد الكهربائي ذي الصلة (ERP) — تتمثل في موجة N400 للعبارات غير المنطقية اجتماعيًا التي تتطلب جهدًا تكامليًا، وموجة P600 للعبارات المستحيلة بيولوجيًا التي تحفز عمليات التصحيح — مما يدعم إطار الاستدلال العقلاني حيث يكيف المستمعون استراتيجيات الفهم لديهم بناءً على طبيعة الانتهاك السياقي.

Hanlin Wu, Zhenguang G. Cai2026-02-13
💬 NLP

NewsInterview: a Dataset and a Playground to Evaluate LLMs' Ground Gap via Informational Interviews

تقدم هذه الورقة البحثية NewsInterview، وهي مجموعة بيانات تضم 40,000 مقابلة معلوماتية وبيئة محاكاة تكشف عن أوجه قصور كبيرة لدى النماذج اللغوية الكبيرة في الحوار الاستراتيجي، مثل التعرف على الأسئلة التي تمت الإجابة عليها والتحول بفعالية، مقارنة بالمحاورين البشر.

Alexander Spangher, Michael Lu, Sriya Jeslyn Kalyan, Hyundong Justin Cho, Weiyan Shi, Jonathan May2026-02-13
💬 NLP

Compositional Generalization from Learned Skills via CoT Training: A Theoretical and Structural Analysis for Reasoning

تُثبت هذه الورقة نظرياً وهيكلياً أن التدريب على "سلسلة الأفك‏ر" (Chain-of-Thought) يعزز قدرة النماذج اللغوية الكبيرة على التعميم التركيبي من خلال تفكيك حدود التعميم إلى مكونات داخل التوزيع وخارج التوزيع، واستدخال الاستدلال في دائرة مكونة من مرحلتين تُعلّم النماذج كيفية التفكير عبر دمج المهارات المتعلمة بدلاً من مجرد حفظ الإجابات.

Xinhao Yao, Ruifeng Ren, Yun Liao, Lizhong Ding, Yong Liu2026-02-13
💬 NLP

Translate Policy to Language: Flow Matching Generated Rewards for LLM Explanations

تقدم هذه الورقة إطار عمل يعزز التفسيرات التي تولدها النماذج اللغوية الكبيرة للوكلاء من خلال تدريبها باستخدام مكافآت توزيعية من تدفقات التنميط المستمر، والتي تُمذل بفعالية الطبيعة التعددية للحكم البشري وتتفوق على النماذج المرجعية الحالية لتعزيز التعلم من التغذية الراجحة البشرية والذكاء الاصطناعي في السلامة المنطقية، والقابلية للتنفيذ، والعبء المعرفي.

Xinyi Yang, Liang Zeng, Heng Dong, Chao Yu, Xiaoran Wu, Huazhong Yang, Yu Wang, Milind Tambe, Tonghan Wang2026-02-13
💬 NLP

AutoDiscovery: Open-ended Scientific Discovery via Bayesian Surprise

تقدم هذه الورقة البحثية AutoDiscovery، وهو نظام اكتشاف علمي ذاتي مفتوح النهايات يستفيد من المفاجأة البايزية (Bayesian surprise) وبحث شجرة مونت كارلو (Monte Carlo tree search) لتوليد وتقييم الفرضيات ذاتياً، مُظهراً أداءً فائقاً في إنتاج اكتشافات مدهشة ومُثبتة من قبل الخبراء عبر مجموعات بيانات واقعية متنوعة مقارنة بالطرق الحالية.

Dhruv Agarwal, Bodhisattwa Prasad Majumder, Reece Adamson, Megha Chakravorty, Satvika Reddy Gavireddy, Aditya Parashar (…)2026-02-13