💬 NLP

ArguLens: An Open-Source System for Automated Essay Scoring and Label-Aware Feedback Generation

تقدم هذه الورقة نظام ArguLens، وهو نظام مفتوح المصدر وقابل للنشر محلياً يعالج أوجه القصور في أدوات تصحيح المقالات الآلية الحالية من خلال تفكيك العملية إلى مصنف للحركات الخطابية، ومُقيّم قائم على الميزات، ومولد تعليقات مدرك للتصنيفات، محققاً أداءً قوياً على مجموعة بيانات PERSUADE 2.0 مع ضمان خصوصية البيانات وقابلية التفسير.

Weiran Wang, Hongxiang Shi, Huitao Tang, Wenjuan Qin2026-08-19
💬 NLP

PTXBench: Benchmark and Adapt LLMs for GPU Kernel Optimization with Architecture-specific PTX

تقدم هذه الورقة PTXBench، وهو معيار لتقييم وتكييف النماذج اللغوية الكبيرة لتوليد لغة PTX الخاصة بالبنية المعمارية من أجل تحسين أداء نوى وحدة معالجة الرسومات (GPU kernels)، كاشفةً أن النماذج الحالية تواجه صعوبة في مطابقة أداء المكتبات الرائدة باستمرار عبر أعباء العمل المعقدة، ومسلطةً الضوء على الدور الحاسم لجودة البيانات وتوازنها في تحسين قدرة النموذج على التعميم من خلال الضبط الدقيق.

Genghan Zhang, Yixin Dong, Chengze Fan, Zhichen Zeng, Yueming Yuan, Shaowei Zhu, Kunle Olukotun2026-08-19
💬 NLP

An Investigation of Translationese in the Generations of Multilingual Large Language Models

تبحث هذه الورقة فيما إذا كانت النماذج اللغوية الكبيرة متعددة اللغات تنتج "لغة ترجمة" تشبه النصوص المترجمة بشرياً، وذلك عبر تحليل السمات اللغوية عبر خمس لغات ومقارنة توليدات النماذج اللغوية الكبيرة بكل من النصوص غير المترجمة والنصوص المكتوبة بشرياً كخطوط أساس.

Maria Valentini, Téa Wright, Julisa Granados, Eliana Colunga, Katharina von der Wense2026-08-19
💬 NLP

From Entity Mentions to Tone: An LLM-Based Pipeline for Media Bias Analysis

تقدم هذه الورقة مساراً قائماً على النماذج اللغوية الكبيرة (LLM) لتحليل الانحياز والتأطير الإعلامي في الأخبار عبر الإنترنت من خلال تجميع المقالات في مواضيع، وتوسيم الكيانات والمشاعر، ومقارنة أنماط التغطية عبر المصادر، مما يثبت فعاليته على مجموعة بيانات من المقالات الإخبارية الألبانية حيث تندر الأدوات المتخصصة.

Klesti Hoxha, Olti Qirici2026-08-19
💬 NLP

Effects of Answer Format Variation on Gender Bias in Large Language Models

تُثبت هذه الورقة أن تنسيق خيارات الإجابة (سواء كانت مغلقة، أو مقياس ليكرت، أو مفتوحة) يغير بشكل كبير قياس التحيز الجنسي والمحاذاة التوزيعية في النماذج اللغوية الكبيرة، مما يؤدي غالباً إلى عكس ترتيب النماذج ويستلزم تصميمات تقييم متعددة التنسيقات لضمان تقييم قوي.

Ksenia Merzlyakova, Sebastian Padó, Franziska Weeber2026-08-19
💬 NLP

ArborMem: Navigating Interaction States with Memory Forests

يقدم البحث ArborMem، وهو إطار عمل ينمذج المحادثات طويلة الأمد كغابات قابلة للتنقل من حالات التفاعل للتعامل بشكل أفضل مع المهام المتداخلة والقابلة للاستئناف، إلى جانب معيار تشخيصي جديد يسمى BranchMemEval، مما يظهر تحسينات كبيرة في الأداء مقارنة بالنماذج المرجعية الحالية في الحفاظ على استمرارية التفاعل.

Zongwei Lv, Yuemeng Xu, Yilun Yao, Siyi Ding, Xinyu Tan, Yaoming Li, Guangxiang Zhao, Weihong Lin, Lin Sun, Xiangzheng Z (…)2026-08-19
💬 NLP

Domain-Adapted Molecular Language Models for Efficient Search of Make-on-Demand Libraries

تُظهر هذه الدراسة أنه في حين تُبدي نماذج اللغة الجزيئية الأصلية أداءً غير متسق عبر المجالات الكيميائية المتنوعة، فإن الضبط الدقيق لها صراحةً على مكتبات افتراضية مستهدفة يعزز بشكل كبير من كفاءة العينات وفائدتها في الاكتشاف الجزيئي مقارنةً بكل من نسخها الأصلية والأساليب المرجعية التقليدية القائمة على البصمات الجزيئية.

Henrik Wille, Luis-Finley Schütz, Felix Strieth-Kalthoff2026-08-19
💬 NLP

Auditing Exposure to Harmful Content on TikTok using Multimodal Language Models: A Cross-National, Age-Stratified Study

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة متعددة الوسائط يمكن أن توفر وسيلة فعالة من حيث التكلفة وقابلة للتوسع لتدقيق تعرض منصة تيك توك للمحتوى الضار عبر فرنسا وإيطاليا والسويد، مما يكشف أن عمليات البحث القائمة على الكلمات المفتاحية تزيد بشكل كبير من التعرض للمحتوى الضار مقارنة بالتصفح السلبي، وأن فلاتر السلامة غالباً ما تقلل من تقدير الأضرار الصريحة.

Hamidreza Saffari, Francesco Pierri2026-08-19
🤖 AI

MoNe: Modular Neural Memory for Efficient Long Context Inference

تُعد MoNe نظام ذاكرة عصبية خفيف الوزن ومعياري يتصل بنماذج المحولات (Transformers) المجمدة لتمكين الاستدلال الفعال للسياقات الطويلة عبر فصل تكلفة الاستدلال عن طول السياق، محققةً تعقيد استعلام ثابتًا وتقليلًا كبيرًا في استخدام الذاكرة دون الحاجة لإعادة التدريب.

Wonguk Cho, Kyubyung Chae, Tribhuvanesh Orekondy, Sunghyun Park, Hyoungwoo Park, Jeongho Kim, Arash Behboodi, Kyuwoong H (…)2026-08-19
💬 NLP

TraceSQL: Traceable Answerability Estimation for Reference-Free Text-to-SQL Verification

تقترح الورقة البحثية TraceSQL، وهو نموذج تحقق خفيف الوزن وقابل للتتبع يستخدم 67 ميزة تشخيصية صريحة لتقدير قابلية الإجابة لاستعلامات SQL المولدة دون مراجع للحقيقة الأرضية، محققاً أداءً تنافسياً مع توفير أدلة قابلة للتفسير لتنبؤاته.

Neelesh Kumar Shukla, Debasmita Panda, Srutanik Bhaduri, Aditya Banerjee, Viji Krishnamurthy2026-08-19