💬 NLP

Generative Active Testing: Efficient LLM Evaluation via Proxy Task Adaptation

تقدم هذه الورقة البحثية "الاختبار النشط التوليدي" (GAT)، وهو إطار عمل مدرك لعدم اليقين يستفيد من النماذج اللغوية الكبيرة كبدائل ومن وحدة تكيف العبارات المبتكرة لاختيار العينات بكفاءة لتقييم مهام الأسئلة والأجوبة التوليدية، مما يقلل خطأ التقدير بنسبة 40% تقريبًا مقارنة بطرق أخذ العينات التقليدية مع تقليل تكلفة التصنيف من قبل الخبراء إلى أدنى حد.

Aashish Anantha Ramakrishnan, Ardavan Saeedi, Hamid Reza Hassanzadeh, Fazlolah Mohaghegh, Dongwon Lee2026-03-23
💬 NLP

Full-Stack Domain Enhancement for Combustion LLMs: Construction and Optimization

تقدم هذه الورقة أول سير عمل كامل الحزمة ومعزز بالمجال لعلوم الاحتراق، والذي يدمج بناء المتون الآلي، والتدريب المسبق التدريجي، والضبط الدقيق للتعليمات، والتعلم المعزز القائم على المكافأة القابل للتحقق للقضاء على الهلوسة وضمان الالتزام بالقوانين الفيزيائية، وهو ما تم التحقق منه بواسطة معيار FlameBench الجديد الذي أظهر أداءً فائقاً على النماذج الرائدة.

Quanjia Xiao, Weimin Ouyang, Zonglin Yang, Tianhao Wu, Qingguo Zhou, Runze Mao, Zhi X. Chen2026-03-23
💬 NLP

Autonoma: A Hierarchical Multi-Agent Framework for End-to-End Workflow Automation

تقدم هذه الورقة Autonoma، وهو إطار عمل هرمي متعدد الوكلاء يقوم بترجمة المطالبات باللغة الطبيعية إلى سير عمل متين وشامل من البداية إلى النهاية عبر فصل منطق التنسيق عن التنفيذ المتخصص، محققاً بذلك موثوقية عالية وقابلية للتوسع وشمولية مع دعم متعدد الوسائط وثنائي اللغة.

Eslam Reda, Maged Yasser, Sara El-Metwally2026-03-23
💬 NLP

Improving Automatic Summarization of Radiology Reports through Mid-Training of Large Language Models

تُظهر هذه الورقة أن استراتيجية "التدريب المسبق، والتدريب المتوسط، والضبط الدقيق" باستخدام نصوص سريرية واسعة النطاق تُحسن بشكل كبير التلخيص التلقائي لتقارير الأشعة، محققةً أداءً فائقاً في كل من جودة النص وواقعيته مقارنةً بنهج الضبط الدقيق المباشر التقليدي.

Mengxian Lyu, Cheng Peng, Ziyi Chen, Mengyuan Zhang, Jieting Li Lu, Yonghui Wu2026-03-23
💬 NLP

URAG: A Benchmark for Uncertainty Quantification in Retrieval-Augmented Large Language Models

تقدم هذه الورقة URAG، وهو معيار شامل يعيد صياغة مهام التوليد المعزز بالاسترجاع (RAG) مفتوحة النهايات إلى أسئلة متعددة الخيارات لتمكين التكميم المنهجي لعدم اليقين عبر التنبؤ المطابق، مما يكشف عن رؤى نقدية حول كيفية تأثير ضوضاء الاسترجاع، وتعقيد الطريقة، والعوامل النوعية على دقة وموثوقية النماذج اللغوية الكبيرة المعززة بالاسترجاع.

Vinh Nguyen, Cuong Dang, Jiahao Zhang, Hoa Tran, Minh Tran, Trinh Chau, Thai Le, Lu Cheng, Suhang Wang2026-03-23
💬 NLP

Automated Motif Indexing on the Arabian Nights

تقدم هذه الورقة أول نهج حوسبي للفهرسة الآلية للموتيفات، باستخدام متن من "ألف ليلة وليلة" مُشروح يدويًا مقترنًا بفهرس الشامي للموتيفات، لإثبات أن نموذج Llama3 الذي تم ضبطه بدقة يمكنه اكتشاف تعبيرات الموتيف بفعالية وبدرجة F1 تبلغ 0.85.

Ibrahim H. Alyami, Mark A. Finlayson2026-03-23
💰 quantitative finance

Generalized Stock Price Prediction for Multiple Stocks Combined with News Fusion

تقترح هذه الورقة نموذجاً عاماً للتنبؤ بأسعار الأسهم يدمج الأسعار التاريخية مع الأخبار اليومية المفلترة عبر تضمينات أسماء الأسهم وآليات التجميع القائمة على الانتباه ضمن إطار عمل لنموذج لغوي كبير، محققاً انخفاضاً بنسبة 7.11% في متوسط الخطأ المطلق مقارنة بالنماذج المرجعية.

Pei-Jun Liao, Hung-Shin Lee, Yao-Fei Cheng, Li-Wei Chen, Hung-yi Lee, Hsin-Min Wang2026-03-23
💬 NLP

Automatic Analysis of Collaboration Through Human Conversational Data Resources: A Review

تستعرض هذه الورقة التحليل الآلي للتعاون الموجه نحو المهام باستخدام بيانات المحادثات البشرية، مغطيةً النظريات ذات الصلة، ومخططات الترميز، والمهام، ونماذج المحاكاة لتوجيه الأبحاث المستقبلية والتطبيقات العملية.

Yi Yu, Maria Boritchev, Chloé Clavel2026-03-23
💬 NLP

LLM-MRD: LLM-Guided Multi-View Reasoning Distillation for Fake News Detection

تقترح الورقة البحثية إطار عمل LLM-MRD، وهو إطار عمل قائم على علاقة المعلم والطالب يستخدم آلية تقطير المعايرة لنقل معرفة الاستدلال متعدد الرؤى المعقدة من نموذج لغوي كبير (المعلم) إلى نموذج طالب فعال، مما يحقق أداءً هو الأفضل في حالته في كشف الأخبار الزائفة متعدد الوسائط مع التغلب على عدم الكفاءة الحسابية للاستخدام المباشر للنماذج اللغوية الكبيرة.

Weilin Zhou, Shanwen Tan, Enhao Gu, Yurong Qian2026-03-23
💬 NLP

PrefPO: Pairwise Preference Prompt Optimization

يُعدّ PreferPO إطار عمل أدنى للتحسين القائم على التفضيلات، والذي يستفيد من مميز يعتمد على النماذج اللغوية الكبيرة لتحسين المطالبات بشكل تكراري باستخدام معايير اللغة الطبيعية فقط، محققاً أداءً فائقاً عبر الإعدادات المصنفة وغير المصنفة، مع تقليل الإطناب في المطالبات والتكرار والتعرض لثغرات "اختراق المطالبات" بشكل كبير مقارنة بالطرق الحالية.

Rahul Singhal, Pradyumna Tambwekar, Karime Maamari2026-03-23