🔢 mathematics

Real-rootedness of the Poincaré polynomials of M0,n\overline{\mathcal M}_{0,n}: an AI-assisted proof

تقدم هذه الورقة برهاناً مدعوماً بالذكاء الاصطناعي يؤكد حقيقة الجذور الحقيقية لمتعددات حدود بوانكاريه لفضاءات تعديل المنحنيات العقلانية المستقرة وفضاءات فلتون-ماكفرسون، وذلك باستخدام تشويه ثنائي المتغير وحجة ستورم-رول مبتكرة لإثبات التداخل الصارم واللوغاريتمية الفائقة لأعداد بيتي الخاصة بها.

Gergely Bérczi, Young-Hoon Kiem2026-05-29
🤖 machine learning

Parallax: Parameterized Local Linear Attention for Language Modeling

تقدم الورقة البحثية Parallax، وهو آلية انتباه خطي محلي (Local Linear Attention) مُعلمة، قابلة للتوسع ومستقرة عددياً، تحقق تحسينات باريتو في نمذجة اللغة من خلال القضاء على اختناقات الحوسبة في الـ LLA، وتحسين كفاءة الأجهزة، وإظهار تآزر مبتكر مع مُحسّن Muon.

Yifei Zuo, Dhruv Pai, Zhichen Zeng, Alec Dewulf, Shuming Hu, Zhaoran Wang2026-05-29
💻 computer science

UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning

تقدم هذه الورقة البحثية UA-Legal-Bench، وهو معيار مرجعي شامل يتكون من خمس مهام مستمدة من السجل الموحد الضخم لقرارات المحاكم في أوكرانيا لتقييم نماذج اللغات الكبيرة في الاستدلال القانوني الأوكراني، مما يكشف عن رؤى نقدية حول تأثيرات التعلم بلقطات قليلة (few-shot) المعتمدة على المهمة، ومزالق الدقة في البيانات غير المتوازنة، وسلوكيات التوسع المتفاوتة عبر عائلات النماذج المختلفة.

Volodymyr Ovcharov2026-05-29
🤖 AI

Paper Agents, Paper Gains: An Empirical Analysis of DeFi Investment Agents

تحلل هذه الورقة سوق وكلاء الاستثمار في التمويل اللامركزي (DeFi) في مراحله المبكرة، كاشفةً أنه على الرغم من تجاوز القيمة الإجمالية لتقييمات الرموز المشفرة 3 مليارات دولار، إلا أن عمليات النشر الحالية تفتقر إلى التنفيذ الذاتي القوي، وتُظهر تركيزاً شديداً للثروة مع خسائر صافية كبيرة للمستخدمين المتوسطين، وتعاني من انفصال هائل بين القيمة السوقية وأساسيات الخزانة، مما يشير إلى الحاجة إلى إطار عمل للنضج لإرساء معايير استثمارية رفيعة المستوى.

Jay Yu, Amy Zhao, Danning Sui2026-05-29
🔬 materials science

Sustainable Metal-Organic Framework Water Harvesters in the Artificial Intelligence Era

يستكشف هذا المقال المنظوري كيفية دمج الذكاء الاصطناي مع مبادئ التصميم المتقدمة، مثل الامتزاز التعاوني والاستراتيجيات متعددة المتغيرات، لتسريع اكتشاف وتحسين الأطر المعدنية العضوية المستدامة من أجل حصاد المياه الجوية بكفاءة في الظروف القاحلة.

Reid A. Coyle (Department of Chemistry, Washington University, St. Louis, MO, United States), Shyam Chand Pal (Departmen (…)2026-05-29
🤖 machine learning

TIMEGATE: Sustainable Time-Boxed Promotion Gates for Continual ML Adaptation Under Resource Constraints

تقدم الورقة البحثية TIMEGATE، وهو إطار عمل للسياسات من أجل تعلم آلي مستمر ومستدام يعمل على تحسين دورات التكيف المقيدة بالموارد عبر موازنة الوقت والحوسبة، وذلك باستخدام إشارة توفر المقياس لتمكين عمليات التقييم الجزئي التي تقلل بشكل كبير من تكاليف الطاقة ووقت التنفيذ مع الحفاظ على الدقة عبر نماذج ومجموعات بيانات متنوعة.

Abhijit Chakrabroty, Suddhasvatta Das, Kevin A. Gary, Yash Shah2026-05-29
🤖 machine learning

Stochastic Lifting for Generating Trajectories of Stochastic Physical Systems

تقدم هذه الورقة البحثية "الرفع العشوائي" (Stochastic Lifting)، وهي طريقة تهدف إلى نمذجة الأنظمة الفيزيائية العشوائية السلسة من خلال تعزيز انتقالات الحالة بملصقات عشوائية مستقلة عالية الأبعاد لتعلم خريطة حتمية قادرة على توليد مسارات متنوعة وغير منهارة عبر الاستدلال ذاتي الانحدار.

Jules Berman, Tobias Blickhan, Benjamin Peherstorfer2026-05-29
🤖 AI

GTA: Generating Long-Horizon Tasks for Web Agents at Scale

تقدم هذه الورقة البحثية GTA، وهو إطار عمل قابل للتوسع يقوم تلقائياً بتوليد مهام لوكلاء الويب متعددة الخطوات وواقعية مع مسارات قابلة للتنفيذ، وذلك من خلال دمج الزحف، والتوليد القائم على الاسترجاع، والتحقق الآلي للتغلب على قيود المعايير المرجعية الحالية وتمكين التدريب والتقييم القويين.

Tenghao Huang, Kung-Hsiang Huang, Prafulla Kumar Choubey, Yilun Zhou, Muhao Chen, Jonathan May, Chien-Sheng Wu2026-05-29
💻 computer science

Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents

تقدم هذه الورقة إطار عمل AgentREVEAL وHarmURLBench لتوضيح أن الاسترجاع الويب في وكلاء النماذج اللغوية الكبيرة (LLM agents) يؤدي إلى تدهور المحاذاة الأمنية من خلال تضخيم الامتثال الضار عبر كل من التكامل أحادي الخطوة و"مفارقة المصدر الآمن" (Safe Source Paradox)، مما يكشف عن مقايضة أساسية بين السلامة والمنفعة حيث تعمل ذات الصلة التي تجعل الاسترجاع مفيداً كعامل ضعف في الوقت نفسه.

Aditya Nawal, Manit Baser, Mohan Gurusamy2026-05-29
🤖 AI

BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents

تقدم هذه الورقة BenchTrace، وهو معيار ومقياس جديد (معدل تجنب الفشل) صُمم لتقييم جودة التأمل وقدرات التطور المنضبط لوكلاء النماذج اللغوية الكبيرة (LLM agents) بصرامة، كاشفةً أن النماذج الحالية تعاني من صعوبة في تشخيص الفشل، وتتأثر بنسيان الدروس، وتفشل في تعميم التأملات خارج سياقات محددة.

Jiahao Huang, Fei Cheng, Junfeng Jiang, Zefan Yu, Akiko Aizawa2026-05-29