💬 NLP

Exploring Language-Agnosticity in Function Vectors: A Case Study in Machine Translation

تُثبت هذه الورقة أن ناقلات الوظائف (function vectors) المستخرجة من النماذج اللغوية الكبيرة متعددة اللغات تُظهر خصائص غير مرتبطة بلغة محددة، حيث إن ناقلات الترجمة المشتقة من مهام التحويل من الإنجليزية إلى اللغة المستهدفة تتعمم بنجاح لتحسين الأداء عبر اللغات المستهدفة غير المرئية وتنتقل بفعالية إلى النسخ المضبوطة بالتعليمات.

Nurkhan Laiyk, Gerard I. Gállego, Javier Ferrando, Fajri Koto2026-04-22
💬 NLP

Epistemic orientation in parliamentary discourse is associated with deliberative democracy

تقدم هذه الورقة درجة "الدليل ناقص الحدس" (EMI) القابلة للتوسع لتحليل 15 مليون خطاب برلماني عبر سبع دول، كاشفةً أن التوجه الأقوى نحو الاستدلال القائم على الأدلة يرتبط إيجابياً بمستويات أعلى من الديمقراطية التداولية والحوكمة الفعالة بمرور الوقت.

Segun Aroyehun, Stephan Lewandowsky, David Garcia2026-04-22
💬 NLP

Attributing Culture-Conditioned Generations to Pretraining Corpora

تقدم هذه الورقة إطار عمل MEMOed لتوضيح أن التحيزات الثقافية في توليدات النماذج اللغوية الكبيرة تنبع من التوزيعات غير المتكافئة لبيانات ما قبل التدريب، حيث تحفز الثقافات عالية التكرار مخرجات محفوظة بينما تفشل الثقافات منخفضة التكرار غالباً في توليد محتوى ذي صلة.

Huihan Li, Arnav Goel, Keyu He, Xiang Ren2026-04-21
💬 NLP

Estimating Commonsense Plausibility through Semantic Shifts

تقدم هذه الورقة ComPaSS، وهو إطار تمييزي مبتكر يقدر المعقولية المنطقية من خلال قياس التحولات الدلالية الناجمة عن التعزيزات، مما يظهر أداءً متفوقاً على النماذج التوليدية عبر النماذج اللغوية ونماذج اللغة والرؤية، مع تسليط الضوء على فوائد التدريب المسبق التبايني.

Wanqing Cui, Wei Huang, Keping Bi, Jiafeng Guo, Xueqi Cheng2026-04-21
💬 NLP

ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition

تقدم هذه الورقة البحثية "ResearchBench"، وهو أول معيار ضخم وخالٍ من التلوث يقيم النماذج اللغوية الكبيرة في مجال الاكتشاف العلمي عبر تفكيك المهمة إلى استرجاع الإلهام، وتكوين الفرضيات، والتصنيف، مما يكشف عن تفوق النماذج في استرجاع الروابط المعرفية الجديدة عبر 12 تخصصاً.

Yujie Liu, Zonglin Yang, Tong Xie, Jinjie Ni, Ben Gao, Yuqiang Li, Shixiang Tang, Wanli Ouyang, Erik Cambria, Dongzhan Z (…)2026-04-21
💬 NLP

CROC: Evaluating and Training T2I Metrics with Pseudo- and Human-Labeled Contrastive Robustness Checks

تقدم هذه الورقة البحثية CROC، وهو إطار عمل قابل للتوسع لإجراء فحوصات متناقضة مؤتمتة للصلابة، يقوم بتوليد مجموعة بيانات ضخمة ذات تسميات زائفة ومعيار مرجعي خاضع للإشراف البشري لتقييم مقاييس تحويل النص إلى صورة بشكل منهجي، مما يكشف عن عيوب كبيرة في الصلابة في الأساليب الحالية ويُمكّن من تدريب المقياس مفتوح المصدر والأحدث حالياً، CROCScore.

Christoph Leiter, Yuki M. Asano, Margret Keuper, Steffen Eger2026-04-21
💬 NLP

Sense and Sensitivity: Examining the Influence of Semantic Recall on Long Context Code Reasoning

تكشف هذه الورقة أنه بينما تبرع النماذج اللغوية الكبيرة في الاسترجاع اللفظي الحرفي في سياقات الأكواد الطويلة، فإن قدرتها على فهم الدلالات التشغيلية تتدهور بشدة عندما يكون الكود ذو الصلة متمركزاً في المنتصف، مما يشير إلى أن المعايولات المرجعية الحالية تعتمد إلى حد كبير على اختصارات مطابقة الأنماط بدلاً من الاستدلال الدلالي الحقيقي.

Adam Štorek, Mukur Gupta, Samira Hajizadeh, Prashast Srivastava, Suman Jana2026-04-21
💬 NLP

HopWeaver: Cross-Document Synthesis of High-Quality and Authentic Multi-Hop Questions

تقدم هذه الورقة HopWeaver، وهو إطار عمل آلي متعدد المستندات يقوم بتوليد أسئلة متعددة القفزات عالية الجودة وأصيلة دون تدخل بشري، مما يوفر بديلاً منخفض التكلفة للتعليق اليدوي لتقييم وتحسين قدرات الاستدلال في نماذج الإجابة على الأسئلة.

Zhiyu Shen, Jiyuan Liu, Yunhe Pang, Yanghui Rao, Fu Lee Wang, Jianxing Yu2026-04-21
💬 NLP

Frankentext: Stitching random text fragments into long-form narratives

تقدم هذه الورقة "فرانكنتيكست" (Frankentext)، وهو نموذج لتوليد السرد حيث تقوم النماذج اللغوية الكبيرة بربط مقتطفات مكتوبة بشرياً بنصها الأصكن لتكوين قصص طويلة متماسكة، وهي طريقة تعزز جودة الكتابة والأصالة بشكل كبير مع تحدي أنظمة الكشف عن الذكاء الاصطناعي وإثارة تساؤلات معقدة حول التأليف وحقوق الطبع والنشر.

Chau Minh Pham, Jenna Russell, Dzung Pham, Mohit Iyyer2026-04-21
💬 NLP

ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows

تقدم الورقة البحثية ScienceBoard، وهو بيئة واقعية متعددة المجالات ومعيار مرجعي يتكون من 169 مهمة علمية تم التحقق منها بدقة صُممت لتقييم الوكلاء المستقلين متعددي الوسائط، مما يكشف أن النماذج الحالية المتطورة لا تحقق سوى نسبة نجاح تبلغ 15% في سير العمل العلمي المعقد ويسلط الضوء على الحاجة إلى تحسين مبادئ التصميم لدعم الاكتشاف العلمي المؤتمت.

Qiushi Sun, Zhoumianze Liu, Chang Ma, Zichen Ding, Fangzhi Xu, Zhangyue Yin, Haiteng Zhao, Zhenyu Wu, Kanzhi Cheng, Zhao (…)2026-04-21