💬 NLP

The Newsworthiness of Brazilian Distress: A Peak Analysis on Time Series of International Media Attention to Disasters in Brazil

تحلل هذه الورقة 2,000 مقال إخباري ألماني حول حرائق وانهيارات أرضية في البرازيل من عام 2000 إلى عام 2024 باستخدام تقسيم السلاسل الزمنية لتحديد ذروة الاهتمام الإعلامي وتحديد مدى توافق طفرات التغطية الدولية هذه مع سجلات الكوارث الوطنية والعالمية.

Brielen Madureira, Andreas Niekler, Marc Keuschnigg, Mariana Madruga de Brito2026-05-07
💬 NLP

Graph-Augmented LLMs for Swiss MP Ideology Prediction

تقدم هذه الورقة PG-RAG، وهو إطار عمل للجيل المعزز بالاسترجاع يدمج الرسوم البيانية للمعرفة السياسية مع النماذج اللغوية الكبيرة لتحسين دقة التنبؤ بالمواقف الأيديولوجية لأعضاء البرلمان السويسري بشكل كبير من خلال الاستفادة من الدلالات النصية والعلاقات المتبادلة بين الفاعلين.

Yifei Yuan, Luis Salamanca, Sophia Schlosser, Laurence Brandenberger2026-05-07
💬 NLP

FAAST: Forward-Only Associative Learning via Closed-Form Fast Weights for Test-Time Supervised Adaptation

تُعد FAAST طريقة تعلم ترابطي موجهة للأمام حصرياً، تقوم بتجميع الأمثلة المصنفة تحليلياً في أوزان سريعة في تمريرة واحدة، مما يتيح تكيفاً مُشرفاً ثابتاً في الوقت وفعالاً في الذاكرة عند وقت الاختبار، يحقق أداء الانتشار العكسي مع تقليل العبء الحسابي والذاوي بشكل كبير.

Guangsheng Bao, Hongbo Zhang, Han Cui, Yanbin Zhao, Yue Zhang2026-05-07
💬 NLP

Assessing Cognitive Effort in L2 Idiomatic Processing: An Eye-Tracking Dataset

تقدم هذه الورقة وتتحقق من صحة مجموعة بيانات تتبع حركة العين لمتحدثي اللغة البرتغالية كأهل لغة (L1) للغة الإنجليزية عبر جميع مستويات الكفاءة، مما يثبت أن الأجهزة ذات التردد المنخفض البالغ 60 هرتز يمكنها بفعالية التقاط التكاليف المعرفية لمعالجة الاصطلاحات في اللغة الثانية (L2) وتوفير معيار لتقييم كل من النماذج اللغوية البشرية والاصطناعية.

Eduardo Santos, Juliana Carvalho, César Rennó-Costa2026-05-07
💬 NLP

Anticipating Innovation Using Large Language Models

تقدم هذه الورقة نموذج TechToken، وهو نموذج قائم على تقنية المحولات (transformer) يحلل التحولات الجماعية في لغة براءات الاختراع للكشف عن الإشارات المبكرة للتركيبات التكنولوجية القادمة قبل عقود من حدوثها، مما يحسن التنبؤ بالابتكار ويتفوق على النماذج المتطورة في المهام المتعلقة ببراءات الاختراع.

Enrico Maria Fenoaltea, Filippo Santoro, Giordano De Marzo, Segun Taofeek Aroyehun, Andrea Tacchella2026-05-07
💬 NLP

A Comparative Study of PyCaret AutoML and CNN-BiLSTM for Binary Hate Speech Detection in Indonesian Twitter

تُظهر هذه الدراسة أن نموذج CNN-BiLSTM يتفوق على أفضل مصنف تقليدي (الغابة العشوائية) من PyCaret AutoML في اكتشاف خطاب الكراهية الثنائي على تويتر الإندونيسي، محققاً دقة أعلى بنسبة 6.6% ودرجة F1 أعلى بنسبة 4.2% من خلال الاستفادة بفعالية من تمثيلات الرموز الكثيفة والسياق ثنائي الاتجاه.

Tanty Widiyastuti, Mayada, Adisty Syawalda Ariyanto, Luluk Muthoharoh, Ardika Satria, Martin Clinton Tosima Manullang2026-05-07
💬 NLP

BenCSSmark: Making the Social Sciences Count in LLM Research

تجادل هذه الورقة الموقفية بأن عدم تمثيل مهام العلوم الاجتماعية في اختبارات النماذج اللغوية الكبيرة الحالية يعيق كلاً من تقدم الذكاء الاصطناعي والبحث في العلوم الاجتماعية، وتقترح إدخال "BenCSSmark"—وهو معيار جديد يتكون من مجموعات بيانات مشروحة من قبل علماء اجتماع حاسوبيين—لإنشاء أنظمة ذكاء اصطناعي أكثر قوة وشفافية وصلة بالواقع الاجتماعي.

Arnault Chatelain, Étienne Ollion, Qianwen Guan, Diandra Fabre, Lorraine Goeuriot, Emile Chapuis, Abdelkrim Beloued, Mar (…)2026-05-07
💬 NLP

Sentiment Analysis and Customer Satisfaction Prediction on E-Commerce Platforms Based on YouTube Comments Using the XGBoost Algorithm

تستخدم هذه الدراسة خوارزمية XGBoost المحسّنة باستخدام PyCaret وتقنية ترميز TF-IDF للتنبؤ برضا العملاء من تعليقات يوتيوب المتعلقة بالتجارة الإلكترونية الإندونيسية، مما يكشف أن المصطلحات الاجتماعية والسياسية تؤثر بشكل كبير على قطبية المشاعر.

Ridho Benedictus Togi Manik, Muhammad Aqil Ramadhan, Ihsan Maulana Yusuf, Luluk Muthoharoh, Ardika Satria, Martin Clinto (…)2026-05-07
💬 NLP

A Comparative Analysis of Machine Learning and Deep Learning Models for Tweet Sentiment Classification: A Case Study on the Sentiment140 Dataset

تُظهر هذه الدراسة أن نموذج الانحدار اللوجستي التقليدي مع ميزات (TF-IDF) يتفوق على بنية التعلم العميق المعقدة (BiLSTM) في تصنيف المشاعر على عينة مكونة من 10,000 تغريدة من مجموعة بيانات (Sentiment140)، حيث حقق دقة بنسبة 73.5% مقابل 69.17% مع تجنب الإفراط في التخصيص، مع نشر النتائج عبر تطبيق ويب تفاعلي باستخدام (Streamlit).

Vita Anggraini, Cintya Bella, Bastian, Luluk Muthoharoh, Ardika Satria, Martin C. T. Manullang2026-05-07
📊 statistics

Self-Attention as Transport: Limits of Symmetric Spectral Diagnostics

تثبت هذه الورقة أن التشخيصات الطيفية المتماثلة عمياء جوهرياً عن اتجاه تدفق الانتباه، حيث تقدم إطار عمل ثنائي المحور يجمع بين مقياس سعة "تشيجر" ثنائي الأجزاء ومعامل عدم التماثل للتمييز بنجاح والتنبؤ بأنماط الفشل المتميزة في النماذج اللغوية الكبيرة.

Dominik Dahlem, Diego Maniloff, Mac Misiura2026-05-07