💬 NLP

Understanding Structured Financial Data with LLMs: A Case Study on Fraud Detection

تقدم هذه الورقة FinFRE-RAG، وهو إطار عمل ثنائي المراحل يجمع بين تقليل الميزات الموجه بالأهمية والتعلم السياقي المعزز بالاسترجاع لتمكين النماذج اللغوية الكبيرة من اكتشاف الاحتيال المالي بفعالية من خلال توليد تفسيرات قابلة للتفسير مع تضييق فجوة الأداء مع النماذج الجدولية التقليدية.

Xuwei Tan, Yao Ma, Xueru Zhang2026-04-10
💬 NLP

ModeX: Evaluator-Free Best-of-N Selection for Open-Ended Generation

تقدم الورقة البحثية ModeX، وهو إطار عمل لاختيار "الأفضل من N" (Best-of-N) خالٍ من المقيمين، يستفيد من التجميع الطيفي (spectral clustering) على رسم بياني للتشابه لتحديد الإجماع الدلالي المهيمن بين توليدات متعددة، مما يقدم حلاً فعالاً من حيث الحوسبة لتحسين التوليد النصي مفتوح النهايات دون الاعتماد على مقيمين خارجيين أو نماذج مكافأة.

Hyeong Kyu Choi, Sharon Li2026-04-10
💬 NLP

DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs

تُعدُّ DyCP طريقةً خفيفة الوزن لإدارة السياق الخارجي، حيث تحدد وتسترجع ديناميكيًا أجزاء الحوار ذات الصلة للمحادثات طويلة الأمد دون بناء ذاكرة غير متصلة بالإنترنت، مما يحقق جودة إجابة تنافسية وكفاءة استدلال محسنة عبر معايير متعددة ونماذج لغوية كبيرة متنوعة.

Nayoung Choi, Jonathan Zhang, Jinho D. Choi2026-04-10
💬 NLP

Generating Literature-Driven Scientific Theories at Scale

تقدم هذه الورقة إطار عمل قابلاً للتوسع لتخليق النظريات العلمية من مجموعات ضخمة من الأدبيات، مما يثبت أن التوليد المرتكز على الأدبيات يتفوق بشكل كبير على الذاكرة البارامترية للنماذج اللغوية الكبيرة في كل من التوافق مع الأدلة الحالية والتنبؤ بالنتائج العلمية المستقبلية.

Peter Jansen, Peter Clark, Doug Downey, Daniel S. Weld2026-04-10
💬 NLP

Testimole-Conversational: A 30-Billion-Word Italian Discussion Board Corpus (1996-2024) for Language Modeling and Sociolinguistic Research

تقدم هذه الورقة البحثية "Testimole-conversational"، وهو متن لغوي متاح مجانًا يتكون من 30 مليار كلمة من رسائل لوحات النقاش الإيطالية الممتدة من عام 1996 إلى عام 2024، والمصمم لدعم التدريب المسبق للنماذج اللغوية الكبيرة الإيطالية الأصلية وتسهيل الأبحاث في اللسانيات، واللسانيات الاجتماعية، والتفاعل الاجتماعي عبر الإنترنت.

Matteo Rinaldi, Rossella Varvara, Viviana Patti2026-04-10
💬 NLP

Exploring Plan Space through Conversation: An Agentic Framework for LLM-Mediated Explanations in Planning

تقدم هذه الورقة إطار عمل للنماذج اللغوية الكبيرة متعددة الوكلاء يسهل التخطيط التفاعلي الموجه من قبل المستخدم عبر توليد تفسيرات باللغة الطبيعية تستجيب لاستفسارات المستخدم، مما يثبت من خلال دراسة مستخدم أن هذا النهج يتفوق على الواجهات التقليدية القائمة على القوالب في شرح تضارب الأهداف.

Guilhem Fouilhé, Rebecca Eifler, Antonin Poché, Sylvie Thiébaux, Nicholas Asher2026-04-10
💬 NLP

Hybrid CNN-Transformer Architecture for Arabic Speech Emotion Recognition

تقدم هذه الورقة بنية هجينة تجمع بين الشبكات العصبية الالتفافية (CNN) والمحولات (Transformer) للتعرف على الانفعالات في الكلام العربي، والتي حققت دقة بلغت 97.8% على مجموعة بيانات EYASE من خلال الجمع بين استخراج الميزات الطيفية الالتفافية ونمذجة التبعية الزمنية القائمة على المحولات.

Youcef Soufiane Gheffari, Oussama Mustapha Benouddane, Samiya Silarbi2026-04-10
💻 computer science

Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference

يُعد Flux Attention إطار عمل كفؤ من حيث المعلمات وسياقي، يقوم بتوجيه طبقات المحولات ديناميكيًا بين آليات الانتباه الكامل والآليات المتفرقة للقضاء على اختناقات المزامنة وتحقيق تسريع في الاستدلال يصل إلى 2.8 ضعف مع الحفاظ على أداء عالٍ في سيناريوهات النماذج اللغوية الكبيرة ذات السياق الطويل.

Quantong Qiu, Zhiyi Hong, Yi Yang, Haitian Wang, Kebin Liu, Qingqing Dang, Juntao Li, Min Zhang2026-04-10
💻 computer science

SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval

يُعد SubSearch إطار عمل غير خاضع للإشراف يعزز عمليات الاسترجاع والاستدلال المعقدة في النماذج اللغوية الكبيرة من خلال تحسين المولدات مباشرةً باستخدام مكافآت وسيطة ذاتية، مما يلغي الحاجة إلى الإشراف الخارجي مع إنتاج مسارات استدلال أكثر متانة من النهج القائم على النتائج فقط.

Roxana Petcu, Evangelos Kanoulas, Maarten de Rijke2026-04-10