🤖 AI

Transforming Science with Large Language Models: A Survey on AI-assisted Scientific Discovery, Experimentation, Content Generation, and Evaluation

تقدم هذه الدراسة نظرة شاملة على المنظومة الناشئة للنماذج اللغوية الكبيرة والأدوات التي تدعم الباحثين عبر الدورة العلمية بأكملها، حيث تغطي المهام الرئيسية بدءاً من البحث في الأدبيات وتوليد الأفكار وصولاً إلى إنشاء المحتوى والتجريب والتقييم، مع معالجة مجموعات البيانات والأساليب والقيود والمخاوف الأخية المرتبطة بها.

Steffen Eger, Yong Cao, Jennifer D'Souza, Andreas Geiger, Christian Greisinger, Stephanie Gross, Yufang Hou, Brigitte Kr (…)2026-03-09
🤖 AI

RM-R1: Reward Modeling as Reasoning

تقدم الورقة البحثية نماذج مكافأة الاستدلال (ReasRMs)، وتحديداً عائلة RM-R1، التي تعيد صياغة نمذجة المكافأة كمسألة استدلال باستخدام آلية "سلسلة المعايير" (chain-of-rubrics) ومسار تدريب ثنائي المرحلة لتحقيق قدرة فائقة على التفسير والأداء مقارنة بالنماذج الضخمة الحالية.

Xiusi Chen, Gaotang Li, Ziqi Wang, Bowen Jin, Cheng Qian, Yu Wang, Hongru Wang, Yu Zhang, Denghui Zhang, Tong Zhang, Han (…)2026-03-09
🤖 AI

Maximizing Asynchronicity in Event-based Neural Networks

تقدم هذه الورقة البحثية EVA، وهو إطار عمل جديد للتحويل من غير متزامن إلى متزامن (A2S) على مستوى الحدث مستوحى من نمذجة اللغة، والذي يولد سمات عالية التعبير، متفوقاً بذلك على الأساليب السابقة في مهام التعرف ومحققاً نتائج هي الأفضل في مجالها في اكتشاف الأحداث للرؤية القائمة على الأحداث.

Haiqing Hao, Nikola Zubić, Weihua He, Zhipeng Sui, Davide Scaramuzza, Wenhui Wang2026-03-09
💬 NLP

ESGenius: Benchmarking LLMs on Environmental, Social, and Governance (ESG) and Sustainability Knowledge

تقدم الورقة البحثية ESGenius، وهو أول معيار شامل يتكون من مجموعة منسقة من وثائق الحوكمة البيئية والاجتماعية وحوكمة الشركات (ESG) الموثوقة ومجموعة بيانات أسئلة وأجوبة تم التحقق منها بدقة، والتي تكشف أنه بينما تظهر النماذج اللغوية الكبيرة أداءً متوسطاً في وضع "الصفر محاولة" (zero-shot) في مجالات الاستدامة، فإن دقتها تتحسن بشكل كبير عندما تعتمد على التوليد المعزز بالاسترجاع (RAG) باستخدام المواد المصدرية المقدمة.

Chaoyue He, Xin Zhou, Yi Wu, Xinjia Yu, Yan Zhang, Lei Zhang, Di Wang, Shengfei Lyu, Hong Xu, Xiaoqiao Wang, Wei Liu, Ch (…)2026-03-09
💬 NLP

From Raw Corpora to Domain Benchmarks: Automated Evaluation of LLM Domain Expertise

تقدم هذه الورقة مساراً آلياً حتمياً يحول مجموعات البيانات الخام الخاصة بمجالات معينة إلى اختبارات مرجعية قائمة على أسلوب الإكمال، وذلك لتوفير تقييمات قابلة للتوسع وغير منحازة ومستقلة عن النماذج اللغوية الكبيرة لقياس الخبرة في مجالات محددة في كل من النماذج الأساسية والمصقولة بالتعليمات، مما يعالج بفعالية مشكلات تلوث الاختبارات المرجعية وانحياز الاختيار من متعدد.

Nitin Sharma, Thomas Wolfers, Çağatay Yıldız2026-03-09
🤖 AI

Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts

تقدم الورقة البحثية "Sysformer"، وهو نهج مبتكر يعمل على حماية النماذج اللغوية الكبيرة المجمدة من خلال تعلم تكييف مطالبات النظام في فضاء التضمين لتعزيز متانة السلامة بشكل كبير ضد المدخلات الضارة وهجمات كسر الحماية دون الحاجة إلى ضبط دقيق مكلف للنموذج.

Kartik Sharma, Yiqiao Jin, Vineeth Rakesh, Yingtong Dou, Menghai Pan, Mahashweta Das, Srijan Kumar2026-03-09
🤖 AI

VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models

تقدم هذه الورقة البحثية VLMQ، وهو إطار عمل للكمّنة ما بعد التدريب مصمم لنماذج الرؤية واللغة يستفيد من عامل أهمية مدفوع بالتدرج لمعالجة التمثيل البصري المفرط وفجوات الأنماط، مما يحقق أداءً هو الأفضل في فئته عبر مختلف أحجام النماذج وإعدادات البت المنخفضة.

Yufei Xue, Yushi Huang, Jiawei Shao, Lunjie Zhu, Chi Zhang, Xuelong Li, Jun Zhang2026-03-09
💬 NLP

Agri-Query: A Case Study on RAG vs. Long-Context LLMs for Cross-Lingual Technical Question Answering

تقدم هذه الورقة دراسة حالة تثبت أن تقنية التوليد المعزز بالاسترجاع الهجين (Hybrid RAG) تتفوق باستمرار على التلقين المباشر للسياق الطويل عبر الأدلة التقنية الزراعية باللغات الإنجليزية والفرنسية والألمانية، محققة دقة تزيد عن 85% مع نماذج مثل Gemini 2.5 Flash وQwen 2.5 7B في الإجابة على الأسئلة متعددة اللغات.

Julius Gun, Timo Oksanen2026-03-09
💬 NLP

CMRAG: Co-modality-based visual document retrieval and question answering

تقترح الورقة البحثية إطار عمل CMRAG، وهو إطار مبتكر يعزز استرجاع الوثائق المرئية والإجابة على الأسئلة من خلال توحيد الوسائط النصية والصورية عبر فضاء تضمين مشترك وطريقة استرجاع مشتركة الوسائط ومعيرة، مما يؤدي إلى التفوق على النهج الحالية أحادية الوسائط.

Wang Chen, Wenhan Yu, Guanqiang Qi, Weikang Li, Yang Li, Lei Sha, Deguo Xia, Jizhou Huang2026-03-09
💬 NLP

MERLIN: Multi-Stage Curriculum Alignment for Multilingual Encoder-LLM Integration in Cross-Lingual Reasoning

يُعد MERLIN إطار عمل قائمًا على المنهج الدراسي ومكونًا من مرحلتين، يدمج المشفرات متعددة اللغات مع النماذج اللغوية الكبيرة باستخدام الضبط الدقيق الفعال بتقنية DoRA لتعزيز أداء الاستدلال عبر اللغات بشكل كبير، لا سيما في اللغات ذات الموارد المنخفضة حيث تقصر الأساليب الحالية وحتى نموذج GPT-4o-mini عن تحقيق ذلك.

Kosei Uemura, David Guzmán, Quang Phuoc Nguyen, Jesujoba Oluwadara Alabi, En-shiun Annie Lee, David Ifeoluwa Adelani2026-03-09