🤖 AI

ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding

يُعد ViSAGE إطار عمل ذاكرة وكيلية متعددة الوسائط يعزز فهم الفيديو طويل المدى من خلال بناء ذكريات ذاتية التصحيح ومركزة حول الكيانات عبر الربط عبر الوسائط، والتحسين ثنائي الاتجاه، والتحقق المتقاطع متعدد الوكلاء لمنع خلط الهوية والهلوسة، محققاً تحسناً بنسبة 5.9% في الدقة مقارنة بالنماذج المرجعية الرائدة.

Xinkui Zhao, Enbo Chen, Yifan Zhang, Chang Liu, Guanjie Cheng, Naibo Wang, Yueshen Xu2026-08-03
🤖 AI

Multi-Agent Planning with Spatio-Temporal and Topological Constraints using STL-GO

تتناول هذه الورقة تحدي تخطيط مسار الوكلاء المتعددين في ظل قيود مكانية-زمانية وطوبولوجية معقدة من خلال اقتراح طريقتين للترميز السليم تعتمدان على البرمجة بالصيغ المختلطة (Mixed-Integer Programming) ونظرية التبعية المنطقية (Satisfiability Modulo Theories) لصيغة STL-GO، واللتين تم التحقق من صحتهما عبر واجهة موحدة وتقييمهما على معايسات البحث والإنقاذ متعددة الطائرات بدون طيار الديناميكية.

Sheryl Paul, Vidisha Kudalkar, Anand Balakrishnan, Lars Lindemann, Alberto Speranzon, Jyotirmoy V. Deshmukh2026-08-03
💻 computer science

Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

تقدم هذه الورقة "التوجيه الخوارزمي الاستعاري"، وهي ظاهرة تتسبب فيها التعليمات الاستعارية في اللغة الطبيعية في جعل النماذج اللغوية الكبيرة تنقل بشكل غير لائق الأنماط الإجرائية من مجال مصدر إلى مهام توليد الكود، مما يؤدي إلى خوارزميات غير فعالة، وتقترح إطار عمل MASC لدراسة واستثارة وكشف هذا التحول في الحالة الخفية.

Zhibo Hu, Chen Wang, Yanfeng Shu, Hye-young Paik, Liming Dong, Liming Zhu2026-08-03
🤖 AI

Library Reachability in LSR-Synth: How Anti-Memorization Design Changes the Measurement of Symbolic Discovery

تقيم هذه الورقة قدرة معيار LSR-Synth على التمييز بين المعرفة العلمية المسبقة والبحث التقليدي عن العمليات من خلال إثبات أنه بينما تُعد ضوابط مكافحة الحفظ الخاصة به فعالة، فإن المهام الحالية تقيس في المقام الأول إعادة دمج التعبيرات غير المرئية ضمن مفردات ثابتة بدلاً من المساهمات الفريدة للمعلومات المسبقة للنماذج اللغوية ما لم يتم تقييد تلك المفردات بشكل متعمد.

Zhan'ao Yao, Liang Yin, Zhihao Gao, Boxuan Zhang, Xiaoyu Wu, Linjing Li, Rongyan Wang, Tingwei Chen, Youwei Wang, Xiaoli (…)2026-08-03
🤖 AI

Safety, or Just Capability? A Validity Audit of Agent-Safety Benchmarks

تجادل هذه الورقة بأن معايير سلامة الوكلاء الحالية تفتقر إلى الصلاحية بسبب المقاييس المعيبة، والتصنيفات غير المتسقة، والآثار الناجمة عن صغر حجم العينات، مبرهنةً في نهاية المطاف على أن القدرة العالية للنماذج غالباً ما ترتبط بزيادة مخاطر عدم المواءمة بدلاً من السلامة، مما يستوجب تعريفات دقيقة للمعايير والمقاييس والسلوكيات المستهدفة لأي ادعاء موثوق بالسلامة.

Youting Wang, Xiao Han, Dingyan Shang, Yuan Tang, Bowen Liu2026-08-03
🤖 AI

SciToolAgent-Evo: An Ontology-Aware Self-Evolving Agent for Open-World Scientific Tool Acquisition

تقدم الورقة البحثية SciToolAgent-Evo، وهو وكيل ذاتي التطور مدرك للأنطولوجيا يقوم باكتساب ودمج أدوات علمية جديدة ديناميكيًا في بيئات العالم المفتوح من خلال التعلم التبايني واستراتيجية استكشاف-استغلال قائمة على خوارزمية LinUCB، والتي تم التحقق من صحتها بواسطة معيار OpenSciToolBench الجديد.

Yuqi Tang, Chenyi Zhou, Libin Wang, Keyan Ding, Qiang Zhang, Huajun Chen2026-08-03
🤖 machine learning

Predicting Steel Fatigue Life from Micrographs Using Physics-Informed Deep Learning

تقدم هذه الورقة البحثية CV، وهو إطار عمل للتعلم العميق المستند إلى الفيزياء، يقوم بتقدير عمر الكلال لسبائك الفولاذ خفيفة الوزن بسرعة مباشرة من الصور المجهرية الضوئية بدقة عالية وعدم يقين مُعاير، محققاً معامل تحديد قدره 0.93 في اختبار معياري اصطناعي مع تسليط الضوء على الحاجة إلى التحقق المستقبلي من العينات الواقعية.

Aryuemaan Kumar Chowdhury2026-08-03
🔢 mathematics

A user's guide to PINNs in geometric analysis: lessons from the asymptotic Plateau problem

تُعد هذه الورقة رفيقاً منهجياً لدراسة حول الأسطح الدنيا في الفضاء الزائدي، حيث تُفصّل كيف يمكن لترميز القيود الهندسية مباشرة في بنية الشبكة العصبية وتحسين تقييم متبقي المعادلات التفاضلية الجزئية من خلال "الجيّات" (jets) من الدرجة الثانية وتجميع الرسوم البيانية أن يقلل تكالًف التدريب بمعامل يتراوح بين أربعين إلى خمسين ضعفاً، مما يُمكّن من تطبيقات فعالة للشبكات العصبية المستوحاة من الفيزياء في التحليل الهندسي.

Tancredi Schettini Gherardini2026-08-03
🤖 AI

DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing

إن DragonCrawl هو إطار عمل لاختبار تطبيقات الهاتف المحمول يعتمد على الذكاء الاصطناعي والنية (intent-based)، ويستفيد من القدرات متعددة الوسائط لنموذج GPT-4o لتحقيق معدلات نجاح عالية، وتقليل وقت تهيئة الاختبارات بشكل جذري، والقضاء على أعباء الصيانة من خلال التحقق من تدفقات مستخدم محددة في خطوط أنابيب التكامل المستمر والتسليم المستمر (CI/CD)، وبذلك يتغلب على قيود القابلية للتوسع والهشاشة التي تعيب اختبارات الطرف إلى الطرف التقليدية.

Sowjanya Puligadda, Mengdie Zhang, Ali Zamani, Dhruva Dixith Kurra, Eric Chen, Juan Marcano2026-08-03
📊 statistics

WaiT for the Signal: Simple Frequency-Aware Flow-Matching

تقدم الورقة البحثية WaiT، وهو محول صور مدرك للمويجات (wavelet-aware image Transformer) يعمل على تحسين توليد الصور عالية الدقة من خلال تفكيك الصور إلى نطاقات ترددية وتأخير صقل الترددات العالية حتى تظهر الهياكل الخشنة، مما يحقق دقة فائقة في فضاء البكسل (pixel-space fidelity) وتكاليف حوسبة منخفضة مع التوسع بفعالية في توليد الفيديو.

Krunoslav Lehman Pavasovic, Théophane Vallaeys, Stéphane Mallat, Giulio Biroli, Luke Zettlemoyer, Brian Karrer, Jakob Ve (…)2026-08-03