🤖 AI

Reliable Reasoning with Large Language Models via Preference-Based Maximum Satisfiability

تقترح هذه الورقة إطار عمل استدلالي هجين حيث تقوم النماذج اللغوية الكبيرة بتوليد كود بايثون لترميز مهام الاستدلال القائمة على التفضيلات كمسائل MaxSAT، والتي يتم حلها والتحقق منها بواسطة أدوات حل دقيقة لتحقيق معدلات أعلى بكثير من حيث الجدوى والصحة مقارنة بالنماذج المرجعية التي تعتمد على الإجابة المباشرة أو سلسلة الأفكوت.

Pedro Orvalho, Marta Kwiatkowska, Guillem Alenyà, Felip Manyà2026-05-29
🤖 AI

FHRFormer: A Self-Supervised Masked Transformer Framework for Fetal Heart Rate Time-Series Inpainting and Forecasting

تقدم هذه الورقة FHRFormer، وهو إطار عمل محول مقنع ذاتي الإشراف يعيد بناء بيانات معدل ضربات قلب الجنين المفقودة بفعالية ويتنبأ بالإشارات المستقبلية من خلال التقاط الخصائص الزمنية والترددية المحلية، مما يتغلب على قيود طرق الاستيفاء التقليدية لتعزيز تقييم مخاطر الجنين القائم على الذكاء الاصطناعي.

Kjersti Engan, Neel Kanwal, Anita Yeconia, Ladislaus Blacy, Yuda Munyaw, Estomih Mduma, Hege Ersdal2026-05-29
🤖 AI

Multi-Legal-Bench: Evaluating LLMs on Legal Reasoning Across Jurisdictions, Languages, and Legal Traditions

تقدم هذه الورقة البحثية "Multi-Legal-Bench"، وهو أول معيار تقييم عابر للولايات القضائية لتقييم الاستدلال القانوني عبر ست دول وأربع عائلات لغوية، والذي يكشف أن أداء المهام يتباين بشكل كبير حسب الولاية القضائية وأن توافق مجموعة الملصقات، وليس التقارب اللغوي أو كفاءة الرمز (tokenizer)، هو المتنبئ الرئيسي لنجاح نقل التعلم القليل الأمثلة (few-shot transfer) عبر اللغات.

Volodymyr Ovcharov2026-05-29
🤖 AI

Citation-Closure Retrieval and Per-Rule Attribution for Real-World Regulatory Compliance Question Answering

تقدم هذه الورقة RefWalk، وهو إطار عمل موحد مصمم لتعزيز الإجابة على أسئلة الامتثال التنظيمي من خلال فرض الإسناد لكل قاعدة وعمليات البحث الإجرائية المهيكلة، والذي تم التحقق من صحته من خلال معيار RegOps-Bench الجديد ومجموعة بيانات الامتثال الصحي في الولايات المتحدة.

Yeong-Joon Ju, Seong-Whan Lee2026-05-29
🤖 AI

Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence

تقترح هذه الورقة البحثية HetMedAgent، وهو إطار عمل متعدد الوكلاء غير متجانس ينظم التعاون بين النماذج اللغوية الكبيرة العامة، والنماذج المتخصصة في مجالات محددة، والأطباء، لإثبات أن النماذج المتخصصة تظل لا غنى عنها لتحقيق اتخاذ قرارات طبية فائقة من خلال دمج الأدلة والإدارة التكيفية لعدم اليقين.

Yanan Wang, Shuaicong Hu, Jian Liu, Guohui Zhou, Aiguo Wang, Cuiwei Yang2026-05-29
🤖 AI

Benchmarking Positional Encoding Strategies for Transformer-Based EEG Foundation Models

تُقيّم هذه الورقة خمس استراتيجيات للترميز الموضعي ضمن هيكل CBraMod Transformer لنماذج التأسيس الخاصة بتخطيط كهربائية الدماغ (EEG)، كاشفةً عن عدم تفوق استراتيجية واحدة بشكل عالمي على الأخريات عبر المهام، حيث تميز الترميز الموضعي الكروي في تخيل الحركة، بينما قدم الترميز الموضعي الشرطي غير المتماثل أداءً أكثر اتساقاً عبر سيناريوهات فك التشفير المتنوعة.

Ayse Betul Yuce, Sebastian Stober2026-05-29
🤖 AI

LFQ: Logit-aware Final-block Quantization for Boosting the Generation Quality of Low-Bit Quantized LLMs

تقدم هذه الورقة البحثية تقنية التكميم الواعي باللوجيت (LFQ) في الكتلة النهائية، وهي طريقة تكميم ما بعد التدريب تعمل على تحسين جودة توليد النماذج اللغوية الكبيرة ذات البتات المنخفضة من خلال تحسين كتلة "ترانسفورمر" النهائية لتقليل الإنتروبيا المتقاطعة بين اللوجيتات، مما يؤدي إلى تصحيح عدم توافق التوزيع الناتج عن النهج التقليدي القائم على الكتل.

Jung Hyun Lee, June Yong Yang, Jungwook Choi, Eunho Yang2026-05-29
🤖 AI

From XXLTraffic to EvoXXLTraffic: Scaling Traffic Forecasting to Sensor-Evolving Networks

تقدم هذه الورقة مجموعتي بيانات XXLTraffic وEvoXXLTraffic لمعالجة أوجه القصور في معايير القياس ذات المستشعرات الثابتة، وذلك من خلال توفير بيانات حركة مرور فائقة الطول ومتطورة المستشعرات تكشف عن فشل العديد من النماذج المتطورة في شبكات الطرق الواقعية والمتنامية باستمرار.

Du Yin, Hao Xue, Arian Prabowo, Shuang Ao, Flora Salim2026-05-29
🤖 machine learning

Hista and Numca: Estimate State Value Effectively for LLM Reinforcement Learning

تتناول هذه الورقة تحدي عدم دقة تقدير قيمة الحالة في التعلم التعزيزي للنماذج اللغوية الكبيرة من خلال تقديم معيار تقدير قيمة الحالة (SVEB) واقتراح تقنيتين جديدتين، Numca وHista، اللتين تعملان على تحسين استقرار الأداء وكفاءته بشكل كبير دون إضافة عبء حوسبي كبير.

Zizhe Chen, Jiqian Dong, Yizhou Tian, Garry Yang, Yongqiang Chen, Zhitang Chen, James Cheng2026-05-29
🤖 AI

Croissant Tasks: A Metadata Format for Reproducible Machine Learning Evaluations

تقدم الورقة البحثية "مهام كرواسان" (Croissant Tasks)، وهي تنسيق بيانات وصفية تصريحي يتيح إمكانية إعادة الإنتاج المفاهيمي في تعلم الآلة من خلال السماح للوكلاء المستقلين بتوليد تنفيذات مستقلة ووظيفية من مواصفات عالية المستوى بدلاً من الاعتماد على تكرار الكود المصدري الهش.

Omar Benjelloun, Leonardo Martins Bianco, Isabelle Guyon, Thanh Gia Hieu Khuong, Jonathan Lebensold, Sebastian Lobentanz (…)2026-05-29