🤖 machine learning

Provable Sparse Inversion and Token Relabel Enhanced One-shot Federated Learning with ViTs

تقترح هذه الورقة البحثية إطار عمل FedMITR، وهو إطار تعلم اتحادي من خطوة واحدة (one-shot) لنماذج المحولات الرؤيوية (Vision Transformers)، يجمع بين عكس النموذج المتناثر (sparse model inversion) لتوليد بيانات اصطناعية متوافقة دلاليًا واستراتيجية إعادة تسمية الرموز (token relabeling) لتعزيز متانة التنبؤ، مما يحقق أداءً فائقًا وحدود تعميم أكثر إحكامًا في ظل ظروف التوزيع غير المتماثل للبيانات (non-IID).

Li Shen, Xiaolei Hao, Qinglun Li, Xiaochun Cao, Zhifeng Hao, Xun Yang2026-05-12
🤖 AI

GridProbe: Posterior-Probing for Adaptive Test-Time Compute in Long-Video VLMs

يقدم GridProbe نموذجاً حسابياً تكيفياً في وقت الاختبار وخالياً من التدريب لنماذج الرؤية واللغة (VLMs) للفيديوهات الطويلة، يعتمد على سبر البعد اللاحق (posterior probing) على شبكة إطارية لتوليد خرائط أهمية قابلة للتفسير، مما يتيح اختياراً ديناميكياً للإطارات يقلل بشكل كبير من التكلفة الحسابية مع الحفاظ على الدقة أو تحسينها في المهام التي تتطلب قدرات استدلالية عالية.

Mohamed Eltahir, Lama Ayash, Ali Habibullah, Tanveer Hussain, Naeemullah Khan2026-05-12
🤖 AI

MPerS: Dynamic MLLM MixExperts Perception-Guided Remote Sensing Scene Segmentation

يُعد MPerS إطار عمل مبتكر لتجزئة مشاهد الاستشعار عن بُعد يستفيد من مطالبات "خليط الخبراء الديناميكي" (Mixture-of-Experts) لتوليد أوصاف عالية الجودة من نماذج لغوية بصرية متعددة (MLLMs)، والتي يتم دمجها تكيفياً عبر وحدة "الخليط الديناميكي للخبراء" (Dynamic MixExperts) وانتباه موجه بالاستعلام اللغوي لتوجيه الميزات البصرية المستخرجة بواسطة DINOv3 لتحقيق أداء تجزئة فائق.

Ziyi Wang, Xianping Ma, Ziyao Wang, Hongyang Zhang, Man On Pun2026-05-12
🤖 AI

Beyond the Last Layer: Multi-Layer Representation Fusion for Visual Tokenizatio

تقدم هذه الورقة البحثية DRoRAE، وهو مشفر تلقائي للتمثيل خفيف الوزن يحسن جودة الترميز البصري والتوليد بشكل كبير من خلال دمج الميزات الهرمية من جميع طبقات المشفر البصري المجمد تكيفياً، بدلاً من الاعتماد فقط على الطبقة النهائية، مما يكشف عن علاقة لوغاريتمية خطية قابلة للتوسع بين قدرة الدمج وأداء إعادة البناء.

Xuanyu Zhu, Yan Bai, Yang Shi, Yihang Lou, Yuanxing Zhang, Jing Jin, Yuan Zhou2026-05-12
🤖 AI

ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox

تقدم الورقة البحثية ComplexMCP، وهو معيار مرجعي صارم مبني على بروتوكول سياق النموذج (Model Context Protocol) يضم أكثر من 300 أداة مترابطة ومحاكاة بيئية ديناميكية، والذي يكشف أن وكلاء النماذج اللغوية الكبيرة الحاليين يقل أداؤهم بشكل كبير عن البشر في سير العمل المعقد بسبب اختناقات مثل تشبع استرجاع الأدوات، والثقة المفرطة، والهزيمة الاستراتيجية.

Yuanyang Li, Xue Yang, Longyue Wang, Weihua Luo, Hongyang Chen2026-05-12
🤖 AI

PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering

يُعد PathISE إطار عمل مبتكر يتعلم إشراف المسارات الوسيطة عالية الجودة من تسميات مستوى الإجابة باستخدام مُقدِّر محول (transformer) خفيف الوزن لتدريب مُوَلِّد مسارات لنماذج اللغة الكبيرة (LLM)، مما يحقق أداءً تنافسيًا في الإجابة على أسئلة الرسوم البيانية للمعرفة دون الاعتماد على بيانات المسارات المشروحة يدويًا والمكلفة.

Shengxiang Gao, Chao Lei, Jey Han Lau, Jianzhong Qi2026-05-12
🤖 AI

Interpretable Machine Learning for Football Performance Analysis: Evidence of Limited Transferability from Elite Leagues to University Competition

تُظهر هذه الدراسة أنه في حين أن نماذج تعلم الآلة المدربة على بيانات كرة القدم الأوروبية النخبوية تقدم تفسيرات مستقرة ومتسقة للأداء، إلا أن هذه الرؤى تفشل في الانتقال بشكل موثوق إلى مستوى المنافسات الجامعية، مما يكشف أن متانة القابلية للتفسير تعتمد على المجال، وأن عدم استقرار التفسير يمكن أن يعمل كإشارة تشخيصية للاختلافات الهيكلية بين مستويات المنافسة.

Yu-Fang Tsai, Yu-Jen Chen, Kok-Hua Tan, Sheng-Chieh Huang, You-Ying Ji, Yu-Lun Chen, Chun-Yi Wang, Chien-Ming Hsu2026-05-12
📊 statistics

Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge

تقدم هذه الورقة البحثية RACER، وهو إطار عمل توجيهي تكيفي قوي يختار ديناميكيًا بين أحكام النماذج اللغوية الكبيرة (LLMs) القائمة على الاستنتاج وغير القائمة عليه تحت ميزانية ثابتة من خلال حل مسألة تحسين متينة توزيعيًا، مما يحقق مقايضات فائقة بين الدقة والتكلفة مع مراعاة التحولات في التوزيع.

Wenbo Zhang, Lijinghua Zhang, Liner Xiang, Hengrui Cai2026-05-12
🤖 AI

PhyGround: Benchmarking Physical Reasoning in Generative World Models

تقدم الورقة البحثية PhyGround، وهو معيار مرجعي شامل يتميز بـ 250 مطالبة منسقة، وتصنيف مكون من 13 قانوناً، وحكم متخصص في النماذج اللغوية البصرية (PhyJudge-9B) لتقييم وتشخيص قدرات الاستدلال الفيزيائي لنماذج الفيديو التوليدية بصرامة من خلال تعليق بشري واسع النطاق ومحكم الجودة.

Juyi Lin, Arash Akbari, Yumei He, Lin Zhao, Haichao Zhang, Arman Akbari, Xingchen Xu, Zoe Y. Lu, Enfu Nan, Hokin Deng, E (…)2026-05-12
🤖 AI

Threat Modelling using Domain-Adapted Language Models: Empirical Evaluation and Insights

تقدم هذه الورقة تقييماً تجريبياً شاملاً للنماذج اللغوية الكبيرة والصغيرة المتكيفة مع المجال لنمذجة تهديدات STRIDE في شبكات الجيل الخامس (5G)، كاشفةً أن التكيف مع المجال أو توسيع نطاق النماذج لا يضمن باستمرار أداءً موثوقاً، مما يسلط الض الضوء على القيود الجوهرية للنماذج اللغوية الكبيرة الحالية في المهام الأمنية المهيكلة والحاجة إلى تعزيز القدرة على الاستنتاج والترسيخ.

Saba Pourhanifeh, AbdulAziz AbdulGhaffar, Ashraf Matrawy2026-05-12