💬 NLP

SynthWorlds: Controlled Parallel Worlds for Disentangling Reasoning and Knowledge in Language Models

تقدم الورقة البحثية SynthWorlds، وهو إطار عمل قابل للتوسع يقوم ببناء مجموعات بيانات متوازية حقيقية واصطناعية ذات هياكل متطابقة لفصل وتقييم المساهمات المتميزة للاستدلال والمعرفة البارامترية في النماذج اللغوية، مما يكشف عن فجوة أداء مستمرة حتى عند تعزيز المعرفة.

Ken Gu, Advait Bhat, Mike A Merrill, Robert West, Xin Liu, Daniel McDuff, Tim Althoff2026-03-11
💬 NLP

Automatic Paper Reviewing with Heterogeneous Graph Reasoning over LLM-Simulated Reviewer-Author Debates

تقترح الورقة البحثية ReViewGraph، وهو إطار عمل مبتكر يحاكي مناظرات متعددة الجولات بين المراجع والمؤلف باستخدام وكلاء يعتمدون على النماذج اللغوية الكبيرة، ويقوم بترميز تفاعلاتهم الحجاجية في رسم بياني غير متجانس، ويطبق الشبكات العصبية الرسومية لتحقيق مراجعات أوراق بحثية أكثر دقة وتعليلاً، متفوقاً بذلك على النماذج المرجعية الحالية بنسبة 15.73%.

Shuaimin Li, Liyang Fan, Yufang Lin, Zeyang Li, Xian Wei, Shiwen Ni, Hamid Alinejad-Rokny, Min Yang2026-03-11
💬 NLP

Does Scientific Writing Converge to U.S. English? Evidence from Generative AI-Assisted Publications

من خلال تحليل واسع النطاق لـ 5.65 مليون مقال علمي، تجد هذه الدراسة أن أدوات الذكاء الاصطناعي التوليدي تدفع المؤلفين غير الناطقين بالإنجليزية نحو التقارب بشكل متزايد مع المعايير الأسلوبية للغة الإنجليزية الأمريكية، لا سيما في السياقات التي كانت فيها الحواجز اللغوية تاريخياً أكثر أهمية، مما يقلل من عقبات النشر ويثير في الوقت ذاته تساؤلات حول التنوع اللغوي.

Dragan Filimonovic, Christian Rutzer, Jeffrey Macher, Rolf Weder2026-03-11
🤖 AI

Enhancing Retrieval-Augmented Generation with Entity Linking for Educational Platforms

تقدم هذه الورقة البحثية نظام ELERAG، وهو نظام معزز لتوليد النصوص المستند إلى الاسترجاع يدمج الربط الكياني القائم على Wikidata واستراتيجية إعادة ترتيب هجينة لتحسين الدقة الواقعية بشكل كبير في مجال الأسئلة والأجوبة التعليمية باللغة الإيطالية، متفوقاً بشكل خاص على الطرق القياسية في السياقات المتخصصة مع إثبات أهمية الاستراتيجيات المتكيفة مع المجال.

Francesco Granata, Francesco Poggi, Misael Mongiovì2026-03-11
💬 NLP

EVM-QuestBench: An Execution-Grounded Benchmark for Natural-Language Transaction Code Generation

تقدم هذه الورقة EVM-QuestBench، وهو معيار تقييم قائم على التنفيذ صُمم لتقييم سلامة ودقة توليد كود المعاملات من اللغة الطبيعية على السلاسل المتوافقة مع EVM بصرامة، وذلك من خلال اختبار ديناميكي قائم على التفرع (fork-based testing) لـ 107 مهمة ذرية ومركبة.

Pei Yang, Wanyi Chen, Ke Wang, Lynn Ai, Eric Yang, Tianyu Shi2026-03-11
⚡ electrical engineering

Rethinking Discrete Speech Representation Tokens for Accent Generation

تقدم هذه الورقة أول استقصاء منهجي حول كيفية ترميز معلومات اللكنة في رموز تمثيل الكلام المنفصلة (DSRTs)، مقدمةً إطار تقييم موحد يكشف أن اختيار الطبقة هو العامل الأكثر حسمًا للاحتفاظ باللكنات، بينما تؤدي الإشرافات الخاصة بالتعرف التلقائي على الكلام (ASR) إلى تقليلها بشكل كبير، في حين يفشل الاختزال الساذج لكتاب الرموز (codebook) في الفصل بين اللكنة والمعلومات الصوتية ومعلومات المتحدث.

Jinzuomu Zhong, Yi Wang, Korin Richmond, Peter Bell2026-03-11
💬 NLP

Query-focused and Memory-aware Reranker for Long Context Processing

تقترح هذه الورقة إطار عمل لإعادة الترتيب خفيف الوزن ومراعٍ للذاكرة، يستفيد من درجات الانتباه من رؤوس مختارة في النماذج صغيرة النطاق لتحقيق أداء رائد في معالجة السياقات الطويلة وفهم الحوار عبر توفير درجات صلة قائمة (listwise) مستمرة دون الحاجة إلى إشراف بمقياس ليكرت.

Yuqing Li, Jiangnan Li, Mo Yu, Guoxuan Ding, Zheng Lin, Weiping Wang, Jie Zhou2026-03-11
🤖 machine learning

Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis

تقدم الورقة البحثية إطار عمل "المفقود بالتصميم" (Missing-by-Design - MBD)، وهو إطار موحد لتحليل المشاعر متعدد الوسائط القابل للإلغاء، يجمع بين تعلم التمثيل الهيكلي ومسار تعديل المعلمات القابل للتحقق لتمكين الحذف الذي يمكن التحقق منه آلياً لوسائط بيانات محددة مع الحفاظ على الأداء التنبؤي والامتثال للخصوصية.

Rong Fu, Ziming Wang, Chunlei Meng, Jiaxuan Lu, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong2026-03-11
💬 NLP

AuditBench: Evaluating Alignment Auditing Techniques on Models with Hidden Behaviors

تقدم هذه الورقة AuditBench، وهو معيار مرجعي يضم 56 نموذجاً لغوياً مزروعاً بها سلوكيات خفية، لتقييم تقنيات تدقيق المحاذاة وكشف أن أدوات التلقين ذات الصندوق الأسود ذات السقالات هي الأكثر فعالية، إلا أن أداءها غالباً ما يتدهور عند دمجها في الوكلاء المستقلين، كما تتباين صعوبة التدقيق بشكل كبير بناءً على طرق تدريب النماذج.

Abhay Sheshadri, Aidan Ewart, Kai Fronsdal, Isha Gupta, Samuel R. Bowman, Sara Price, Samuel Marks, Rowan Wang2026-03-11
💬 NLP

A Browser-based Open Source Assistant for Multimodal Content Verification

تقدم هذه الورقة "مساعد التحقق" (VERIFICATION ASSISTANT)، وهو أداة مفتوحة المصدر قائمة على المتصفح ومدمجة في إضافة مستخدمة على نطاق واسع، تُمكّن الصحفيين ومدققي الحقائق من خلال توحيد مصنفات معالجة اللغات الطبيعية (NLP) المتعددة لتحليل الروابط وملفات الوسائط تلقائياً بحثاً عن إشارات المصداقية والمحتوى المُنشأ بواسطة الذكاء الاصطناي.

Rosanna Milner, Michael Foster, Olesya Razuvayevskaya, Ian Roberts, Valentin Porcellini, Denis Teyssou, Kalina Bontcheva2026-03-11