💻 computer science

Stop Shipping AI Agents on Faith: Capability Is Not Production Readiness

تقدم هذه الورقة "مؤشر وكيل الإثبات" (PAI)، وهو إطار عمل للجاهزية الحوكمية ينقل قرارات نشر وكلاء الذكاء الاصطناعي من الاعتماد على استعراض القدرات إلى تقييم قابل للتدقيق رباعي الأبعاد يشمل التقييم، والسياق، والامتثال، والحوكمة، والذي تم التحقق من صحته في المجالات المنظمة للتمييز بين الجاهزية للإنتاج ومجرد القدرة الوظيفية.

Fouad Bousetouane2026-07-31
💻 computer science

MECA: A Mechanism-Centered Agent for Constructing Well-Specified and Valuable Mathematical Conjectures

تقدم الورقة البحثية MECA، وهو إطار عمل متعدد الوكلاء يستفيد من الاستدلال المتمحور حول الآليات لتحويل توجهات بحثية واسعة إلى حدسيات رياضية محددة جيداً وذات قيمة وتحدٍ، وذلك عبر التطوير المشترك للعبارات المرشحة والآليات الداعمة الكامنة وراءها.

Wentao Long, Yunfei Zhang, Chenyi Li, Zaiwen Wen2026-07-31
💬 NLP

Baikal: Structured Search for Deep Research over Data Lakes

تقدم الورقة البحثية "بايكال" (Baikal)، وهو إطار عمل يعالج أوجه القصور في الاسترجاع التكراري أثناء البحث العميق في بحيرات البيانات من خلال صياغة المهمة كمسألة بحث بميزانية محددة، حيث يتم تجميع الأدلة في مناطق دلالية واستكشافها بشكل تكيفي لتحقيق التوازن بين الاستكشاف والاستغلال، مما يؤدي إلى تقارير ذات جودة أعلى بكثير مقارنة بالنماذج المرجعية الحالية.

Dhruv Agarwal, Rishitha Guttapalle Mohan, Aarti Kumari, Ashi Sinha, Athulya Anil, Kavitha Srinivas, Horst Samulowitz, An (…)2026-07-31
🤖 machine learning

Train Small, Deploy Large: Zero-Shot GNN Transfer Through Geometric Renormalization

تقترح هذه الورقة بروتوكول نقل بنمط "التعلم الصفري" (zero-shot transfer)، حيث يمكن نشر شبكة عصبية رسومية (GNN) تم تدريبها على نسخة مكررة خشنة الحبيبات ومُعاد تطبيعها هندسياً من رسم بياني، مباشرةً على الرسم البياني الأصلي واسع النطاق دون الحاجة لإعادة التدريب، مما يقلل التكاليف الحسابية بشكل كبير مع الحفاظ على الأداء التنبؤي.

Robert Jankowski, Pedro Almagro-Blanco, Marián Boguñá, Melanie Weber, M. Ángeles Serrano2026-07-31
💻 computer science

RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy

يُعد RedFlow إطار عمل للتعلم التعزيزي غير المتصل (offline reinforcement learning) دقيق التفاصيل، يعمل على تعزيز سياسات الرؤية واللغة والعمل (Vision-Language-Action) القائمة على مطابقة التدفق (flow-matching) عبر تحويل تجارب الفشل إلى إشراف تصحيحي على مستوى الإجراء، مما يؤدي إلى تحسين معدلات النجاح في العالم الحقيقي وكفاءة العينات بشكل كبير مقارنة بالطرق الحالية.

Zhengyang Yan, Junhao Li, Fangqi Zhu, Zijun Wang, Quanxin Shou, Yikun Miao, Xiaoyi Pang, Zicong Hong, Song Guo2026-07-31
🤖 machine learning

LoRA Scaffolded Policy Optimization (LSPO): A Sampling-Time Low-Rank Scaffold for Recovering Reinforcement-Learning Gradient on Zero-Reward Cliff Prompts

تقدم هذه الورقة البحثية تحسين السياسة المدعوم بـ LoRA (أو LSPO)، وهي آلية وقت أخذ العينات تعمل على استعادة تدرجات التعلم المعزز في مطالبات "المنحدر" حيث تفشل جميع عينات التدحرج، وذلك عبر ملاءمة محول منخفض الرتبة مؤقتاً لتوليد حلول ناجحة، مما يحسن بشكل كبير من أداء الاستدلال الرياضي في معايير مثل AIME وMATH مقارنة بالنماذج المرجعية القياسية.

Ken Ding2026-07-31
💻 computer science

Annotating Topical Legal Insights from Case Proceedings

تقدم هذه الورقة LeDA، وهو نظام قائم على الويب لتوسيم البيانات القانونية يتيح التوسيم الديناميكي للمفاهيم داخل إجراءات القضايا دون الحاجة إلى أنطولوجيا لإنشاء تمثيلات دلالية مهيكلة لمهام لاحقة مثل استرجاع القضايا السابقة والتنبؤ بالأحكام.

Subinay Adhikary, Dwaipayan Roy, Debasis Ganguly, Shouvik Kumar Guha, Kripabandhu Ghosh2026-07-31
💻 computer science

MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

تقدم هذه الورقة MemeBench، وهو معيار تشخيصي يستخدم مخطط VIKR لتقييم وكشف فجوات المعرفة الثقافية المحددة في تفسير نماذج الرؤية واللغة الكبيرة للميمات، مما يوضح أنه بينما يحسن الاسترجاع الموجه نحو الكيانات من دمج المعرفة، فإنه يضحي حالياً بالتغطية البصرية.

Weihang Wang, Kainan Tu, Jielei Zhang, Run Yang, Boheng Sheng, Yuchen He, Yu Xie, Pengyu Chen, Peiyi Li, Huyang Sun, Lon (…)2026-07-31
💻 computer science

SAFViT: Spatial Attention Fusion Gating for Vision Transformer-Based Nucleus Segmentation and Classification

تقدم هذه الورقة البحثية نموذج SAFViT، وهو نموذج قائم على "Vision Transformer" لتجزئة وتصنيف النواة، والذي يستبدل وصلات التخطي القياسية بوحدة "Spatial Attention Fusion Gating" مبتكرة لوزن ميزات المشفر وفك التشفير ديناميكيًا، مما يحسن بشكل كبير جودة البانوبتيك متعدد الفئات والكشف عن الفئات الأقلية في مجموعتي بيانات PanNuke وMoNuSeg.

Harshit Mittal, Arash Rabbani2026-07-31
💻 computer science

Virtual Process Dossier: A Process-Aware Data Catalogue

تقدم هذه الورقة ملف العملية الافتراضي (VPD)، وهو كتالوج بيانات قائم على الرسوم البيانية للمعرفة مصمم للتصنيع متعدد المراحل يضمن الوصول إلى البيانات وفق معايير FAIR وتتبع أصل سير العمل بشكل صريح من خلال أنطولوجيا مبتكرة، وإطار تكامل، وواجهة مستخدم تركز على الإنسان.

Lukas Kubelka, Alexander Bott, Frank Döhner, Saksham Kiroriwal, Georg Zeeb, Julia Butte, Julius Pfrommer, Jürgen Beyerer (…)2026-07-31