🤖 AI

TLA+^{+}-Bench: An Execution-Grounded Benchmark and Dataset for Natural-Language to TLA+ Specification Generation

يقدم TLA+^{+}-Bench معياراً اختبارياً قائماً على التنفيذ يتضمن 403 مواصفات تم التحقق منها برمجياً، وهو ما يكشف عن "غلاف صحة" واسع عند تقييم كود TLA+^{+} الذي تولده النماذج اللغوية الكبيرة، مما يثبت أن النماذج الحالية تنتج مواصفات صالحة من الناحية التركيبية ولكنها غير صحيحة من الناحية الدلالية بشكل أكثر تكراراً مما تنتج مواصفات صحيحة حقاً.

Arslan Bisharat, Eric Spencer, Brian Ortiz, Khushboo Bhadauria, Mujtaba Nazari, Beatriz Santos, Anisa Ramos, TaiNing Wan (…)2026-07-28
📊 statistics

A Characterization of the Orthocomplement of the Tangent Space of Semiparametric Markov Models

تستنتج هذه الورقة تعبيرات ذات صيغة مغلقة للمتمم المتعامد للفضاء المماسي في نماذج ماركوف شبه المعلمية العامة، مما يتيح بذلك توصيف جميع دالات التأثير وتسهيل الاستدلال شبه المعلمي الفعال للنماذج المعرفة بواسطة الرسوم البيانية غير الموجهة، والرسوم البيانية السلسلية، والرسوم البيانية الموجهة المختلطة اللا-دورية حيث لم تكن مثل هذه التوصيفات متاحة سابقاً.

Trung Phung, Ilya Shpitser2026-07-28
💬 NLP

Do Small Models Use the Law You Give Them? Context-Injected Fine-Tuning for Legal QA in Bangladesh

تُثبت هذه الورقة أن الضبط الدقيق للنماذج اللغوية الصغيرة ثنائية اللغة باستخدام أمثلة قانونية محقونة بالسياق يحسن بشكل كبير قدرتها على التطبيق الصحيح للنصوص التشريعية البنغلاديشية المسترجعة والحفاظ على اتساق اللغة، رغم أن هذه المكاسب تتباين باختلاف حجم النموذج ولا تفيد النماذج الأكبر حجماً بشكل موحد.

Moniruzzaman Mahadi, Abrar Mohammed Tanzim Alam, Sayma Siddika Monalisa, Mir Mohammad Asif Abdullah, Swakkhar Shatabda (…)2026-07-28
🤖 AI

Token-Region Guided Cross-Attention Fusion for Multimodal Affect Interpretation

تقترح هذه الورقة إطار عمل لدمج الانتباه المتقاطع الموجه بالرمز والمنطقة (Token-Region Guided Cross-Attention Fusion) يدمج ميزات النصوص البصرية وعمليات التعرف الضوئي على الحروف (OCR) عالية الدقة عبر آلية انتباه متعدد الرؤوس، محققاً أداءً هو الأفضل في فئته في اكتشاف النوايا السياسية داخل الميمز (memes) باللغة البنغالية ذات الموارد المنخفضة.

Musa Tur Farazi, Nufayer Jahan Reza2026-07-28
🔢 mathematics

Formalizing Flag Algebras in Lean

تقدم هذه الورقة صياغة رسمية مُحققة آلياً لطريقة جبر الأعلام لـ "رازبوروف" في لغة "لين" (Lean)، وتتميز بمُترجم يتحقق بشكل مستقل من شهادات البرمجة شبه المحددة لإثبات سبعة حدود عليا من نوع "توران" بصرامة واستكشاف الفروق الدقيقة في الميتا-نظرية لفرض قيود الرسوم البيانية.

Gyeongwon Jeong, Seonghun Park, Jihoon Hyun, Sang-il Oum, Hongseok Yang2026-07-28
🤖 AI

Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework

يقدم هذا التقرير إطار عمل عملي ومبنياً على الأدلة لاختيار نماذج تضمين النصوص من خلال مقارنة واجهة برمجة تطبيقات تجارية بالبدائل مفتوحة المصدر عبر مهام متنوعة، وتحليل كيفية تفاعل اختيار النموذج مع استراتيجيات الفهرسة والبحث والتقسيم ضمن مسار استرجاع كامل، وذلك لتوجيه قرارات النشر بناءً على قيود المهمة وزمن الاستج وحجم التكلفة.

Madhav S Baidya2026-07-28
💬 NLP

Novel Claim or Déjà Vu? Rethinking "Contamination-Free'' Dynamic Evaluation for Multimodal Automated Fact-Checking

تتحدى هذه الورقة الافتراض القائل بأن المعايير المرجعية الديناميكية خالية بطبيعتها من التلوث، وذلك من خلال إثبات أن جزءاً كبيراً من الادعاءات التي تلت تاريخ القطع لا تزال قابلة للتحقق عبر المعرفة الموجودة مسبقاً، مما يمكن أن يؤدي إلى تضخيم أداء التحقق من الحقائق متعدد الوسائط بشكل مصطنع وتشويه تصنيفات الأنظمة، الأمر الذي يستلزم بروتوكولات تقييم أكثر صرامة.

Haorui He, Xinwen Chen, Dacheng Wen, Reynold Cheng, Francis C. M. Lau, Yupeng Li2026-07-28✓ Author reviewed
🤖 AI

Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis

تقدم هذه الورقة "ذكاء التفويض" (Delegation Intelligence) كإطار عمل مفكك لتقييم وكلاء البحث العميق من خلال الفصل بين اتخاذ قرار البحث وتوليف المعلومات، مدعوماً بمسار توليف قابل للتحكم وبمعيار DelegSearchBench للكشف عن أوجه القصور في مقاييس الدقة الحالية القائمة على النماذج المتكاملة (end-to-end).

Xinhao Yao, Yuanzhuo Liu, Changhao Wang, Yunfei Yu, Haoran Tan, Yuyao Zhang, Ruifeng Ren, Minlong Peng, Yong Liu2026-07-28
⚡ electrical engineering

Neonatal Hypoxic-ischaemic Encephalopathy Classification from the EEG and HRV Signals Using a Conformer based Masked Autoencoder

تقدم هذه الورقة MAEConformer، وهو إطار عمل جديد للتعلم الخاضع للإشراف الذاتي يجمع بين بنية Conformer والمشفرات التلقائية المقنعة (Masked Autoencoders) وفقدان الطيف متعدد الدقة للتدريب المسبق على بيانات ضخمة غير مصنفة من تخطيط كهربائية الدماغ (EEG) وتقلب ضربات القلب (HRV)، محققاً أداءً هو الأفضل في حالته لتصنيف شدة اعتلال الدماغ بنقص التروية ونقص الأكسجة لدى حديثي الولادة.

Shuwen Yu, William P Marnane, Geraldine B. Boylan, Gordon Lightbody2026-07-28
🤖 machine learning

An Unofficial FastLAS Tutorial: A Programmer's Guide

تُعد هذه الورقة بمثابة دليل مبرمج عملي وغير رسمي لإصدار FastLAS 2.2.0، حيث تقدم مقدمة تركز على بناء الجمل البرمجية (syntax) من خلال أمثلة متدرجة الصعوبة ومحققة لتعليم المستخدمين كيفية بناء قواعد البرامج المنطقية للبرمجة المنطقية الاستقرائية (Inductive Logic Programming) مع تسليط الضوء على الاختلافات الجوهرية بينها وبين الأنظمة ذات الصلة.

Fabio Aurelio D'Asaro2026-07-28