💻 computer science

World Action Planner: Generalizable Decision-Making with Action-Conditioned World Models

تقدم الورقة البحثية "مخطط عالم الأفعال" (World Action Planner)، وهو نظام تخطيط روبوتي يجمع بين نماذج الرؤية واللغة ونموذج عالم متعدد المهام مشروط بوضعية الصورة، لتمكين الوكلاء من تحسين خطط الأفعال بشكل تكراري من خلال عمليات محاكاة تخيلية، مما يحقق تعميماً فائقاً عبر المشاهد والمهام الجديدة مقارنة بالسياسات الحالية المتطورة التي تعمل بنظام النهاية إلى النهاية.

Xiangcheng Zhang, Yilun Du2026-07-31
💻 computer science

Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting

تجادل هذه الورقة بأن تقييمات المتانة الحالية للتنبؤ بحركة المرور القائمة على الرسوم البيانية تعتمد على نماذج تهديد غير واقعية، وتقترح دفاعاً جديداً للكشف والتخفيف باستخدام كاشف مستند إلى الفيزياء يواجه بفعالية الهجمات المستهدفة والواعية بالفيزياء مع الحفاظ على تكلفة تقترب من الصفر على البيانات السليمة.

Qingzhao Zhang2026-07-31
💬 NLP

DualAnchor: Preserving Language Priors and Improving Lexical Fidelity in Gloss-Free Sign Language Translation

تقترح الورقة البحثية DualAnchor، وهو إطار عمل لترجمة لغة الإشارة بدون رموز (gloss-free) يجمع بين "الترسيخ المسبق على مستوى الرمز" (Token-level Prior Anchoring) للحفاظ على سلاسة اللغة و"محاذاة النقل الأمثل" (Optimal Transport Alignment) لتعزيز الدقة المعجمية، مما يعالج المشكلات الشائعة المتمثلة في تدهور الأولوية اللغوية والفجوات المعجمية في الأساليب الحالية القائمة على النماذج اللغوية الكبيرة (LLM).

Hongbin Zhang, Junhao Liu, Xuefeng Bai, Youcheng Pan, Yang Xiang, Kehai Chen2026-07-31
💻 computer science

Hidden APIs in Language Models: Discovering Reusable Causal Interfaces from Forked Futures

تقدم هذه الورقة "المستقبلات المتشعبة" (forked futures)، وهي طريقة لتحديد الواجهات السببية القابلة لإعادة الاستخدام في النماذج اللغوية من خلال مقارنة الحالات الخفية بناءً على توزيعات استجابة المستقبل المستحثة لها، مما يثبت أن الواجهة "المشتركة" توفر التمثيل الأكثر اقتصاداً ومتانة عبر بنيات النماذج المتعددة.

SiYuan Ma, Yiqin Luo, Zhangji, Canran Xiao, Albert Gao, Wei-Hsing Huang, Wei Wang, Qiwei Wu, Xinran Li, Jinfeng Wei, Qi (…)2026-07-31
💻 computer science

Arm2Air: Cross-Embodiment Skeleton Transfer for 3D Relay Formation

يقدم Arm2Air إطار عمل فعال حوسبياً وبيانياً ينقل هياكل تجنب العوائق من الأذرع الروبوتية إلى وضع أجهزة ترحيل الطائرات بدون طيار عبر النقل عبر الأجساد وتكييف التكيف منخفض الرتبة، مما يحسن بشكل كبير سرعة التخطيط وأداء الشبكة في البيئات الحضرية ثلاثية الأبعاد المعقدة مقارنة بالطرق التقليدية.

Dohun Lee, Kyeonghyun Yoo, Seokmin Kim, Byongho Lee, Seungjoo Oh, Hwangnam Kim2026-07-31
💬 NLP

ReDiPPO: Reference-Guided Value Calibration and Discrepancy-Aware Token Reweighting for Mathematical Reasoning

تُعد ReDiPPO إطار عمل جديدًا لـ PPO مخصصًا للاستدلال الرياضي، حيث يعمل على تعزيز تخصيص الائتمان على مستوى الرمز (token) من خلال الاستفيد من تقدير القيمة الموجه بالمرجع وإعادة وزن المزايا بناءً على التفاوت بين تقديرات القيمة الموجهة بالمرجع والتقديرات القياسية لمعالجة تحديات المكافآت المتفرقة والتقييمات الضوضائية.

Zhenrong Zhang, Fei Wu, Jun Du, Jianshu Zhang, Si Wei2026-07-31
🤖 machine learning

HealthCAT: An Interpretable Encoder-only Transformer Framework for Health Indicator Prediction and Temporal Interpretation of Wearable Sensor Data

يُعد HealthCAT إطار عمل "ترانسفورمر" (Transformer) يعتمد على نظام "المُشفّر فقط" (Encoder-only) وقابل للتفسير، يتفوق على النماذج المرجعية الحالية للتعلم العميق في التنبؤ بالمؤشرات الصحية من بيانات أجهزة الاستشعار القابلة للارتداء، مع توفير رؤى موثقة على مستوى الخطوات الزمنية للأنماط السلوكية المحددة التي تقود تلك التنبؤات.

Xiaotong Yu, Joshua Y. Kim, HaeJin Lee, Kalina Yacef2026-07-31
💻 computer science

HALO: Heterogeneous Admission through Localized Obligations for Safe Agentic Execution

تقدم هذه الورقة بروتوكول HALO، وهو بروتوكول وقت تشغيل يضمن التنفيذ الوكيل الآمن من خلال القبول الانتقائي للمكونات المدعومة من استجابات الذكاء الاصطناعي غير المتجانسة بناءً على الالتزامات المحلية وإعادة التحقق من الإجراءات قبل الإرسال، متفوقاً بذلك على سياسات رفض الاستجابة الكاملة في الاحتفاظ بالوظائف المفيدة مع منع العمليات القديمة أو غير الآمنة.

Taewoo Park, Kyeonghyun Yoo, Kiseok Kim, Seunghyun Yoo, Hwangnam Kim2026-07-31
🤖 machine learning

Understanding Submodular Information Measure Based Objectives for Representation Learning: A Variance and Separation Perspective

تؤسس هذه الورقة إطاراً نظرياً موحداً يربط مقاييس المعلومات تحت المدارية (SIMs) بالمفاهيم الإحصائية الكلاسيكية، مبرهنةً على أن أهدافاً محددة لمقاييس المعلومات تحت المدارية (إجمالي المعلومات والمعلومات المتبادلة) تميز بشكل فريد خصائص التباين داخل الفئة الواحدة والتمايز بين الفئات، وهي نظرية تم التحقق من صحتها من خلال تجارب اصطناعية مضبوطة.

Rishabh Iyer, Truong Pham, Anay Majee2026-07-31
💻 computer science

JigShape: Evaluating Visual-Geometric Reasoning in VLMs through Jigsaw Puzzles

تقدم الورقة البحثية JigShape، وهو معيار لألغاز الصور المقطوعة (jigsaw puzzle) بقطع متداخلة يكشف عن افتقار نماذج الرؤية واللغة الحالية إلى الاستدلال الهندسي القوي، حيث تفشل في التوسع لما بعد الشبكات الصغيرة رغم الأداء القوي في ألغاز 4×4 البسيطة.

Shawn Li, Wei Yang, Jike Zhong, Jiate Li, Jiawei Yang, You Qin, Ryan Rossi, Franck Dernoncourt, Roger Zimmermann, Yue Wa (…)2026-07-31