💬 NLP

Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions

تقدم هذه الورقة معياراً للتقييم الميتافيزيقي القائم على الأبعاد والمستند إلى الأسس اللغوية لأنظمة تحويل النص إلى كلام، لتكشف أن المقيمات الآلية الحالية، بما في ذلك متنبئات متوسط درجة التفضيل (MOS) وقضاة النماذج اللغوية الكبيرة الصوتية (Audio-LLM)، تفشل في رصد كامل نطاق أبعاد الإدراك الصوتي بما يتجاوز الجودة الصوتية الأساسية بشكل موثوق.

Oluwanifemi Bamgbose, Simon Rosen, Jash Shah, Lindsay Devon Brin, Hoang H Nguyen, Anke Koelzer, Rachel Hansen, Tara Boga (…)2026-08-11
💬 NLP

Detection of Emotions in Hindi-English Code Mixed Text Data

تقدم هذه الورقة مجموعة بيانات مشروحة جديدة لنصوص هجينة من اللغتين الهندية والإنجليزية، وتقترح طريقة تطبيع مقيدة بالصوامت لتحسين الكشف عن العواطف، حيث أثبتت أن نموذج (sub-word LSTM) يحقق أعلى دقة (76.6%) من بين خمسة نماذج مرجعية تمت مقارنتها لتصنيف الغضب والخوف والسعادة والحزن.

Divyansh Singh2026-08-10
🤖 AI

Harnessing the Synergy between LLM Agents and Knowledge Graphs for Urban Socioeconomic Prediction

تقترح هذه الورقة إطار عمل تآزرياً يدمج وكلاء النماذج اللغوية الكبيرة (LLM) مع الرسوم البيانية للمعرفة لتعزيز التنبؤ بالخصائص الاجتماعية والاقتصادية الحضرية، وذلك عبر الاستفادة من استدلال النماذج اللغوية الكبيرة لتحديد المسارات الوصفية (meta-paths) الخاصة بمهام محددة، وآلية تواصل عبر المهام للدمج المعرفي التكيفي.

Zhilun Zhou, Jingyang Fan, Yu Liu, Fengli Xu, Depeng Jin, Yong Li2026-08-10
💬 NLP

MLLM-based Speech Recognition: When and How is Multimodality Beneficial?

تبحث هذه الورقة في كيفية ومتى يعزز دمج الأنماط المتعددة التعرف التلقائي على الكلام في البيئات الصاخبة، كاشفةً أن الفوائد تعتمد على مستويات الضوضاء، والمزامنة، والجودة البصرية، والخيارات الهيكلية، مع تقديم رؤى عملية لتحسين تصميم النماذج.

Yiwen Guan, Viet Anh Trinh, Vivek Voleti, Jacob Whitehill2026-08-10
💬 NLP

Let's Unlearn Stereotypes Before Decision-Making: Assessing the Impact of Intrinsic Bias Mitigation on Downstream Fairness in LLMs

تقدم هذه الورقة البحثية "إلغاء التعلم المفاهيمي الواعي بالعدالة" (FACU)، وهو أسلوب على مستوى النموذج يقلل بفعالية من التحيز الجنساني الجوهري في النماذج اللغوية الكبيرة، ويؤدي إلى تحسينات ذات دلالة إحصائية في العدالة اللاحقة عبر مختلف مهام التصنيف الاجتماعي والاقتصادي دون المساس بالأداء التنبؤي.

Mina Arzaghi, Alireza Dehghanpour Farashah, Florian Carichon, Jean-François Plante, Golnoosh Farnadi2026-08-10
💬 NLP

AfriNLLB: Efficient Translation Models for African Languages

تقدم هذه الورقة البحثية AfriNLLB، وهي سلسلة من نماذج الترجمة خفيفة الوزن والفعالة لـ 15 زوجًا من اللغات الأفريقية، والتي تحقق أداءً يضاهي النماذج المرجعية الأكبر من خلال التقليم التكراري للطبقات، والكمية، وتقطير المعرفة، مع إطلاق النماذج وبيانات التدريب المنسقة لدعم النشر في البيئات محدودة الموارد ومزيد من الأبحاث.

Yasmin Moslem, Aman Kassahun Wassie, Amanuel Gizachew Abebe2026-08-10
💬 NLP

Angry but Accurate: Detecting and Profiling the Counter-Misinformation Ecosystem on Twitter

من خلال تحليل أكثر من 260,000 تغريدة تتعلق بكوفيد-19، تكشف هذه الدراسة أن المستخدمين المعارضين للمعلومات المضللة هم عادةً أكثر رسوخاً ويعبرون عن مستويات أعلى من المشاعر السلبية مثل الغضب والاشمئزاز، مما يتحدى الافتراض بأن السلبية هي سمة أساسية للأكاذيب.

Eun Cheol Choi, Emilio Ferrara2026-08-10
💬 NLP

Dropping the Anchor: Statistical Context Summarization for Distributed Systems via Pulsar Attention

يعمل نظام Pulsar Attention على تحسين طرق الاستدلال الموزع مثل Star Attention من خلال استبدال المرتكزات الثابتة والمغيبة عن المحتوى بمكونات خفيفة الوزن ومدركة للمحتوى —وهي بادئة مستقرة لامتصاص الانتباه وملخصات عبر الكتل تعتمد على معيار Max-IDF— مما يقلل بشكل كبير من التكاليف الحسابية مع الحفاظ على أداء الانتباه الكثيف أو تجاوزه في التسلسلات الطويلة التي تصل إلى 128 ألف توكن.

Aryan Sood, Shantanu Acharya, Gaurav Kumar Nayak2026-08-10
💬 NLP

OpenForgeRL: Train Harness-native Agents in Any Environment

تُعد OpenForgeRL إطار عمل مفتوح المصدر يُمكّن من التدريب الشامل لوكلاء الذكاء الاصطناعي الأصليين في بيئات متنوعة عبر فصل الاستدلال عن التدريب بواسطة وسيط خفيف الوزن ومنسق كوبرنيتيس (Kubernetes)، محققاً أداءً هو الأفضل في فئته على معايير الأدوات وواجهات المستخدم الرسومية المعقدة، مع توفير رؤى حول كيفية تشكيل خيارات الهيكل (harness) والتعلم التعزيزي لسلوك الوكيل.

Xiao Yu, Baolin Peng, Ruize Xu, Hao Zou, Qianhui Wu, Hao Cheng, Wenlin Yao, Nikhil Singh, Zhou Yu, Jianfeng Gao2026-08-10
💬 NLP

GEB-Bench: Abstract Structures Told in Many Voices

يقدم GEB-Bench معياراً مرجعياً جديداً يقيم قدرة نماذج الذكاء الاصطناعي على التعرف على الزخارف الهيكلية المجردة ورسم خرائطها عبر وسائط متنوعة، مما يكشف عن فجوة ثابتة ومنتظمة بين التعرف أحادي الصوت والتجريد عابر الأصوات، وهي فجوة تستمر حتى في النماذج الرائدة.

Tong Zhang, Zhiyuan Shi, Yun Peng, Tao Xie2026-08-10