🤖 AI

OTT-Vid: Optimal Transport Temporal Token Compression for Video Large Language Models

تقدم الورقة البحثية OTT-Vid، وهو إطار عمل لضغط الرموز الزمني لا يتطلب تدريباً لنماذج اللغة الكبيرة الخاصة بالفيديو، والذي يستفيد من النقل الأمثل مع كتلة رموز غير منتظمة وتكاليف مدركة للمحلية لتخصيص ميزانيات الضغط ديناميكياً بناءً على قابلية ضغط أزواج الإطارات، محققاً أداءً هو الأفضل في فئته مع الاحتفاظ بـ 10% فقط من الرموز المرئية.

Minseok Kang, Minhyeok Lee, Jungho Lee, Minjung Kim, Donghyeong Kim, Dayeon Lee, Heeseung Choi, Ig-jae Kim, Sangyoun Lee2026-05-13
🤖 AI

Beyond World-Frame Action Heads: Motion-Centric Action Frames for Vision-Language-Action Models

تقدم هذه الورقة البحثية MCF-Proto، وهو رأس حركة خفيف الوزن يعزز نماذج الرؤية واللغة والعمل من خلال التنبؤ بإطار محلي متمحور حول الحركة واستخدام المعلمة القائمة على النماذج الأولية لتحقيق تحكم روبوتي في المناولة أكثر إيجازاً ومتانة وتعميماً دون الحاجة إلى إشراف مساعد.

Huoren Yang, Jianchao Zhao, Hu Yusong, Qiguan Ou, Yuyang Gao, Wei Ke, Yuhang He, SongLin Dong, Zhiheng Ma, Yihong Gong2026-05-13
🤖 AI

Automated Reformulation of Robust Optimization via Memory-Augmented Large Language Models

تقدم هذه الورقة AutoRO-Bench، وهو معيار مخصص لتقييم النماذج اللغوية الكبيرة في إعادة صياغة التحسين المتين، وتقترح AutoREM، وهو إطار عمل معزز بالذاكرة وغير معتمد على الضبط، يتعلم ذاتياً من الإخفاقات السابقة لتحسين دقة وكفاءة إعادة الصياغة بشكل كبير عبر مختلف النماذج ومجموعات البيانات.

Jinbiao Chen, Shuang Jin, Guoyun Zhang, Junyu Zhang, Guanyi Wang, Hanzhang Qin2026-05-13
🤖 AI

MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare

يقدم MedMemoryBench إطار عمل مرجعي جديد واسع النطاق لوكلاء الرعاية الصحية الشخصيين، يستخدم مسار تعاوني بين الإنسان والوكيل لتوليد مسارات طبية واقعية وبروتوكول تقييم تدفقي لتقييم أداء الذاكرة بصرامة، مما يكشف عن اختناقات حرجة مثل تشبع الذاكرة في البنيات الحالية.

Yihao Wang, Haoran Xu, Renjie Gu, Yixuan Ye, Xinyi Chen, Xinyu Mu, Yuan Gao, Chunxiao Guo, Peng Wei, Jinjie Gu, Huan Li (…)2026-05-13
🤖 AI

Trade-offs in Decentralized Agentic AI Discovery Across the Compute Continuum

تقيم هذه الورقة المقايضات بين الشبكات المتراكبة المهيكلة من نوع Chord وPastry وKademlia لاكتشاف الوكلاء اللامركزي عبر متصل الحوسبة، مع تحليل أدائها من حيث الموثوقية، وسلوك بدء التشغيل، والعبء الإضافي لطبقة التحكم في ظل كل من ظروف الاستقرار وظروف التغيير العالي، وذلك لتحديد نقاط التشغيل المثلى لبيئات الحافة إلى السحابة.

Patrizio Dazzi, Emanuele Carlini, Matteo Mordacchini, Saul Urso2026-05-13
📊 statistics

Minimax Rates and Spectral Distillation for Tree Ensembles

تحدد هذه الورقة معدلات التقارب المثلى من نوع (minimax) لنموذج الغابة العشوائية في الانحدار عبر ربطها باضمحلال القيم الذاتية لمؤثرات النواة المستحثة، وتستفيد من هذا المنظور الطيفي لتطوير مخططات ضغط عالية الكفاءة تعمل على تقطير مجموعات الأشجار إلى نماذج مدمجة وعالية الأداء.

Binh Duc Vu, David S. Watson2026-05-13
🤖 machine learning

Martingale-Consistent Self-Supervised Learning

تقدم هذه الورقة إطاراً للتعلم الذاتي الإشراف المتمسك بخصائص المارتينجال (martingale-consistent)، والذي يفرض التماسك بين التنبؤات الخشنة والمُحسّنة في ظل الملاحظة الجزئية، مما يؤدي إلى تحسين متانة النموذج ومعايرته مقارنة بأهداف الثبات القياسية.

Moritz Gögl, Hanwen Xing, Christopher Yau2026-05-13
🤖 AI

Very Efficient Listwise Multimodal Reranking for Long Documents

تقدم الورقة البحثية ZipRerank، وهو إعادة ترتيب متعدد الوسائط قائم على القوائم عالي الكفاءة يحقق دقة رائدة في مجالها على المستندات الطويلة مع تقليل زمن انتقال الاستدلال بشكل كبير من خلال إلغاء فك التشفير التوليدي واستخدام استراتيجية تدريب ثنائية المراحل.

Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh2026-05-13
🤖 AI

IPI-proxy: An Intercepting Proxy for Red-Teaming Web-Browsing AI Agents Against Indirect Prompt Injection

تقدم الورقة البحثية IPI-proxy، وهي مجموعة أدوات مفتوحة المصدر تستخدم وكيل اعتراض (intercepting proxy) لإعادة كتابة استجابات HTTP ديناميكيًا من نطاقات مدرجة في القائمة البيضاء باستخدام مكتبة متنوعة من حمولات حقن الأوامر غير المباشرة (indirect prompt injection)، مما يتيح إجراء اختبارات اختراق واقعية وقابلة للتكرار لوكلاء الذكاء الاصطناعي المتصفحين للويب في بيئات شبيهة ببيئات الإنتاج دون الاعتماد على صفحات وهمية.

Chia-Pei (Janet), Chen, Kentaroh Toyoda, Anita Lai, Alex Leung2026-05-13
🤖 AI

From Clever Hans to Scientific Discovery: Interpreting EEG Foundational Transformers with LRP

تُثبت هذه الورقة أن توسيع نطاق انتشار الصلة على مستوى الطبقة (LRP) ليشمل النماذج التأسيسية لتخطيط كهربية الدماغ (EEG) يتحقق بفعالية من عملية اتخاذ القرار لديها عبر كشف عيوب مثل سلوك "كليفر هانز" (Clever Hans)، ويولد فرضيات جديدة ذات صلة بيولوجية فيما يتعلق بأنماط نشاط الدماغ.

Justus Meyer zu Bexten, Nico Scherf, Bogdan Franczyk, Simon M. Hofmann2026-05-13