💬 NLP

RAISE: Enhancing Scientific Reasoning in LLMs via Step-by-Step Retrieval

تقدم الورقة البحثية إطار عمل RAISE، وهو إطار عمل يعتمد على الاسترجاع المعزز خطوة بخطوة يعمل على تعزيز الاستدلال العلمي في النماذج اللغوية الكبيرة من خلال تفكيك المشكلات وتوليد استعلامات منطقية لاسترجاع وثائق ذات صلة منطقية ومتخصصة في المجال من مجموعات البيانات المتاحة في الواقع، مما يؤدي إلى التفوق على النماذج المرجعية الحالية في اختبارات الاستدلال العلمي.

Minhae Oh, Jeonghye Kim, Nakyung Lee, Donggeon Seo, Taeuk Kim, Jungwoo Lee2026-03-20
⚡ electrical engineering

DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment

تقدم الورقة البحثية DeSTA2.5-Audio، وهو نموذج لغوي صوتي ضخم للأغراض العامة يخفف من حدة النسيان الكارثي ويحقق أداءً هو الأفضل في فئته من خلال توظيف استراتيجية محاذاة عبر الوسائط ذاتية التوليد ومجموعة بيانات ضخمة غير مرتبطة بمهام محددة تضم 5 ملايين عينة.

Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Sung-Feng Huang, Chih-Kai Yang, Chee-En Yu, Chun-Wei Chen, Wei- (…)2026-03-20
💬 NLP

Agentic Vehicles for Human-Centered Mobility: Definition, Prospects, and System Implications

تقدم هذه الورقة مفهوم "المركبات الوكيلية" (AgVs) لمعالجة الفجوة بين المركبات ذاتية القيادة التقليدية والأنظمة الناشئة القادرة على التفكير القائم على الأهداف، والتكيف الاستراتيجي، والتفاعل الاجتماعي، مع تحديد التحدات والآفاق لتطوير نقل وكيلِي متمحور حول الإنسان.

Jiangbo Yu, Raphael Frank, Luis Miranda-Moreno, Sasan Jafarnejad, Jonatas Augusto Manzolli, Jiyao Wang, Ali Eslami2026-03-20
💬 NLP

Infherno: End-to-end Agent-based FHIR Resource Synthesis from Free-form Clinical Notes

تقدم الورقة البحثية "إنفيرنو" (Infherno)، وهو إطار عمل قائم على الوكلاء يعمل من البداية إلى النهاية، يستفيد من النماذج اللغوية الكبيرة، وتنفيذ الأكواد، وأدوات المصطلحات الرعاية الصحية لتخليق موارد HL7 FHIR المهيكلة بدقة من الملاحظات السريرية ذات الصيغة الحرة، متفوقاً بذلك على النهج التركيبي السابقة والأسس البشرية مع معالجة مشكلات القابلية للتعميم والمطابقة الهيكلية.

Johann Frei, Nils Feldhus, Lisa Raithel, Roland Roller, Alexander Meyer, Frank Kramer2026-03-20
💬 NLP

Milco: Learned Sparse Retrieval Across Languages via a Multilingual Connector

تقدم الورقة البحثية MILCO، وهي بنية استرجاع متفرقة متعلمة متعددة اللغات ومبتكرة تستفيد من موصل متخصص ورأس LexEcho لتعيين الاستعلامات والمستندات عابرة اللغات في فضاء معجمي إنجليزي مشترك، محققةً أداءً هو الأفضل في فئته وكفاءة متفوقة مقارنة بالنماذج المرجعية الكثيفة والمتفرقة الرائدة.

Thong Nguyen, Yibin Lei, Jia-Huei Ju, Eugene Yang, Andrew Yates2026-03-20
💬 NLP

Redundancy-as-Masking: Formalizing the Artificial Age Score (AAS) to Model Memory Aging in Generative AI

تقدم هذه الورقة "درجة العمر الاصطناعي" (AAS)، وهي مقياس ذو أسس نظرية يحدد كمياً شيخوخة الذاكرة في الذكاء الاصطنا quite التوليدي عبر قياس التباين بين الاستدعاء الدلالي المستقر وانهيار الذاكرة العرضية، مبرهنةً من خلال دراسة استمرت 25 يوماً أن إعادة ضبط الجلسات تحفز الشيخوخة الهيكلية بينما تحافظ السياقات المستمرة على الشباب الهيكلي.

Seyma Yaman Kayadibi2026-03-20
💬 NLP

Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation

تقترح هذه الورقة إطاراً بايزياً منهجياً يستبدل مقياس Pass@k غير المستقر بتقديرات اللاحقة وفترات الثقة لتوفير تصنيفات أكثر موثوقية وكفاءة في الحوسبة ووعياً بحالة عدم اليقين لنماذج اللغات الكبيرة عبر سيناريوهات التقييم الثنائية والمتدرجة على حد سواء.

Mohsen Hariri, Amirhossein Samandar, Michael Hinczewski, Vipin Chaudhary2026-03-20
💬 NLP

DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models

تقدم هذه الورقة البحثية DUAL-Bench، وهو معيار متعدد الوسائط واسع النطاق مصمم لتقييم الإفراط في الرفض والإكمال الآمن في نماذج الرؤية واللغة، مما يكشف أن الأنظمة الحالية تعاني من أجل تحقيق التوازن بين السلامة والمنفعة في سيناريوهات الاستخدام المزدوج من خلال إظهار حالات فشل ثنائية تتمثل إما في الرفض المفرط أو التوليد غير الآمن.

Kaixuan Ren, Preslav Nakov, Usman Naseem2026-03-20
💬 NLP

From Binary to Bilingual: How the National Weather Service is Using Artificial Intelligence to Develop a Comprehensive Translation Program

تستفيد هيئة الأرصاد الجوية الوطنية من شراكة مع شركة LILT في مجال الذكاء الاصطناعي القابل للتوسع والمصمم أخلاقياً لأتمتة ترجمة منتجات الطقس الحيوية إلى لغات متعددة، مما يعزز التواصل بشأن المخاطر ويضمن تقديم تحذيرات في الوقت المناسب وذات صلة ثقافياً لملايين المتحدثين بغير اللغة الإنجليزية في جميع أنحاء الولايات المتحدة.

Joseph E. Trujillo-Falcon, Monica L. Bozeman, Liam E. Llewellyn, Samuel T. Halvorson, Meryl Mizell, Stuti Deshpande, Bob (…)2026-03-20
💬 NLP

Rule-Based Explanations for Retrieval-Augmented LLM Systems

تقترح هذه الورقة إطار عمل مبتكرًا لتوليد قواعد "إذا-فإن" (if-then) لتفسير أنظمة التوليد المعزز بالاسترجاع (RAG) عبر ربط مصادر المعلومات المسترجعة بمخرجات النموذج، وذلك باستخدام تحسينات مستوحاة من خوارزمية "أبريوري" (Apriori) للتغلب بكفاءة على التحديات الحسابية لاختبار دمج المصادر بطريقة القوة الغاشمة.

Joel Rorseth, Parke Godfrey, Lukasz Golab, Divesh Srivastava, Jarek Szlichta2026-03-20