🤖 AI

Library Reachability in LSR-Synth: How Anti-Memorization Design Changes the Measurement of Symbolic Discovery

تقيم هذه الورقة قدرة معيار LSR-Synth على التمييز بين المعرفة العلمية المسبقة والبحث التقليدي عن العمليات من خلال إثبات أنه بينما تُعد ضوابط مكافحة الحفظ الخاصة به فعالة، فإن المهام الحالية تقيس في المقام الأول إعادة دمج التعبيرات غير المرئية ضمن مفردات ثابتة بدلاً من المساهمات الفريدة للمعلومات المسبقة للنماذج اللغوية ما لم يتم تقييد تلك المفردات بشكل متعمد.

Zhan'ao Yao, Liang Yin, Zhihao Gao, Boxuan Zhang, Xiaoyu Wu, Linjing Li, Rongyan Wang, Tingwei Chen, Youwei Wang, Xiaoli (…)2026-08-03
🤖 AI

Safety, or Just Capability? A Validity Audit of Agent-Safety Benchmarks

تجادل هذه الورقة بأن معايير سلامة الوكلاء الحالية تفتقر إلى الصلاحية بسبب المقاييس المعيبة، والتصنيفات غير المتسقة، والآثار الناجمة عن صغر حجم العينات، مبرهنةً في نهاية المطاف على أن القدرة العالية للنماذج غالباً ما ترتبط بزيادة مخاطر عدم المواءمة بدلاً من السلامة، مما يستوجب تعريفات دقيقة للمعايير والمقاييس والسلوكيات المستهدفة لأي ادعاء موثوق بالسلامة.

Youting Wang, Xiao Han, Dingyan Shang, Yuan Tang, Bowen Liu2026-08-03
🤖 AI

SciToolAgent-Evo: An Ontology-Aware Self-Evolving Agent for Open-World Scientific Tool Acquisition

تقدم الورقة البحثية SciToolAgent-Evo، وهو وكيل ذاتي التطور مدرك للأنطولوجيا يقوم باكتساب ودمج أدوات علمية جديدة ديناميكيًا في بيئات العالم المفتوح من خلال التعلم التبايني واستراتيجية استكشاف-استغلال قائمة على خوارزمية LinUCB، والتي تم التحقق من صحتها بواسطة معيار OpenSciToolBench الجديد.

Yuqi Tang, Chenyi Zhou, Libin Wang, Keyan Ding, Qiang Zhang, Huajun Chen2026-08-03
🤖 machine learning

Predicting Steel Fatigue Life from Micrographs Using Physics-Informed Deep Learning

تقدم هذه الورقة البحثية CV، وهو إطار عمل للتعلم العميق المستند إلى الفيزياء، يقوم بتقدير عمر الكلال لسبائك الفولاذ خفيفة الوزن بسرعة مباشرة من الصور المجهرية الضوئية بدقة عالية وعدم يقين مُعاير، محققاً معامل تحديد قدره 0.93 في اختبار معياري اصطناعي مع تسليط الضوء على الحاجة إلى التحقق المستقبلي من العينات الواقعية.

Aryuemaan Kumar Chowdhury2026-08-03
🔢 mathematics

A user's guide to PINNs in geometric analysis: lessons from the asymptotic Plateau problem

تُعد هذه الورقة رفيقاً منهجياً لدراسة حول الأسطح الدنيا في الفضاء الزائدي، حيث تُفصّل كيف يمكن لترميز القيود الهندسية مباشرة في بنية الشبكة العصبية وتحسين تقييم متبقي المعادلات التفاضلية الجزئية من خلال "الجيّات" (jets) من الدرجة الثانية وتجميع الرسوم البيانية أن يقلل تكالًف التدريب بمعامل يتراوح بين أربعين إلى خمسين ضعفاً، مما يُمكّن من تطبيقات فعالة للشبكات العصبية المستوحاة من الفيزياء في التحليل الهندسي.

Tancredi Schettini Gherardini2026-08-03
🤖 AI

DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing

إن DragonCrawl هو إطار عمل لاختبار تطبيقات الهاتف المحمول يعتمد على الذكاء الاصطناعي والنية (intent-based)، ويستفيد من القدرات متعددة الوسائط لنموذج GPT-4o لتحقيق معدلات نجاح عالية، وتقليل وقت تهيئة الاختبارات بشكل جذري، والقضاء على أعباء الصيانة من خلال التحقق من تدفقات مستخدم محددة في خطوط أنابيب التكامل المستمر والتسليم المستمر (CI/CD)، وبذلك يتغلب على قيود القابلية للتوسع والهشاشة التي تعيب اختبارات الطرف إلى الطرف التقليدية.

Sowjanya Puligadda, Mengdie Zhang, Ali Zamani, Dhruva Dixith Kurra, Eric Chen, Juan Marcano2026-08-03
📊 statistics

WaiT for the Signal: Simple Frequency-Aware Flow-Matching

تقدم الورقة البحثية WaiT، وهو محول صور مدرك للمويجات (wavelet-aware image Transformer) يعمل على تحسين توليد الصور عالية الدقة من خلال تفكيك الصور إلى نطاقات ترددية وتأخير صقل الترددات العالية حتى تظهر الهياكل الخشنة، مما يحقق دقة فائقة في فضاء البكسل (pixel-space fidelity) وتكاليف حوسبة منخفضة مع التوسع بفعالية في توليد الفيديو.

Krunoslav Lehman Pavasovic, Théophane Vallaeys, Stéphane Mallat, Giulio Biroli, Luke Zettlemoyer, Brian Karrer, Jakob Ve (…)2026-08-03
🤖 AI

Stratified Negation in RDF Rules: A Correct Approach (Extended Version)

تقترح هذه الورقة "التدرج السلسلي" (chain stratification)، وهو شرط مبتكر يعالج تحديات تطبيق النفي الافتراضي على قواعد RDF والقواعد الوجودية من خلال الجمع بين تحليل الاشتقاق متعدد الخطوات وقيود السلامة لضمان دلالات فريدة، رشيقة، ومبررة بغض النظر عن ترتيب تطبيق القواعد.

Nils Küchenmeister, Alex Ivliev, Dörthe Arndt, Markus Krötzsch2026-08-03
🤖 AI

EarlyDx: An Admission-Anchored Benchmark for Open-Ended Generation of Evidence-Supported ED-Encounter Diagnoses

تقدم هذه الورقة البحثية EarlyDx، وهو معيار مرجعي واسع النطاق للتشخيص الطارئ مفتوح النهايات والقائم على الأدلة باستخدام بيانات مرحلة الدخول فقط من قاعدة بيانات MIMIC-IV، والذي يكشف أن النماذج اللغوية الكبيرة الحالية تواجه صعوبة في استنتاج التشخيصات بشكل موثوق من الأدلة الأولية المحدودة رغم التحسينات التي طرأت بعد مرحلة التدريب.

Jiahui Li, Ruili Fang, Zishuai Liu, Yutong Guo, Nan Yang, Wenzhan Song, Jin Lu, Fei Dou2026-08-03
🤖 AI

Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures

تقدم هذه الورقة تصنيفاً متمحوراً حول التفاعل يحدد مواضع فشل الوكيل في تفاعلات مكونات محددة وجوانب أعطال معينة، مما يحول الملصقات الغامضة القائمة على النتائج إلى مهام إصلاح قابلة للتنفيذ للنماذج أو الأطر أو البيئات لتحسين أنظمة الوكلاء عبر مختلف البنيات.

Harsh Raj, Vipul Gupta, Anas Mahmoud, Razvan-Gabriel Dumitru, Darvin Yi, Aakash Sabharwal, Yunzhong He2026-08-03