🤖 AI

Specification-Based Code-Text-Code Reengineering for LLM-Mediated Software Evolution

تقترح هذه الورقة إطار عمل لإعادة الهندسة من نوع (Code2Text2Code) قائم على المواصفات، يعمل على الحد من الانحراف الدلالي وعدم الاتساق السلوكي في تطور البرمجيات بوساطة النماذج اللغوية الكبيرة، وذلك عبر تحويل الكود المصدري إلى مواصفات نصية محايدة للتحقق التكراري قبل إعادة توليد الكود المستهدف.

Oleg Grynets, Vasyl Lyashkevych, Arsen Dolichnyi, Roman Piznak, Taras Zelenyy, Volodymyr Morozov2026-05-26
🤖 AI

Meta-Agent: From Task Descriptions to Verified Multi-Agent Systems

تقدم الورقة البحثية Meta-Agent، وهو إطار عمل ثنائي المراحل يقوم تلقائياً ببناء وتنفيذ أنظمة متعددة الوكلاء موثوقة من خلال الأوصاف اللغوية الطبيعية عبر دمج تخطيط المهام، والتأصيل القائم على الويب، وآلية تحقق متعددة المستويات للكشف عن الأخطاء والتعافي منها طوال سير العمل.

Andy Xu, Yu-Wing Tai2026-05-26
📊 statistics

On the Epistemic Uncertainty of Overparametrized Neural Networks

تتحدى هذه الورقة الرؤية التقليدية القائلة بأن عدم اليقين المعرفي يتلاشى مع زيادة البيانات من خلال إثبات أنه في الشبكات العصبية ذات المعلمات الزائدة، يؤدي عدم التحديد الناتج عن التماثلات والتمثيلات الفائضة إلى استمرار عدم اليقين في المعلمات حتى عندما يتم تحديد الدالة الأساسية بشكل كامل، وهي ظاهرة يحللها المؤلفون نظرياً ويتحققون منها تجريبياً في شبكات ReLU ذات الطبقة المخفية الواحدة.

David Rügamer2026-05-26
🤖 machine learning

Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies

تقدم هذه الورقة طريقة عزو مرساة بالقيود لسياسات الأمثلة التوليفية العصبية، والتي تقوم بتفكيك القرارات عبر ثنائيات الاسترخاء الخطي (LP-relaxation duals)، وتصديق الحالات المضادة باستخدام نماذج الجدوى التوليفية، وتحديد حدود أحجام التفسير الكافية باختبارات PAC المصححة بطريقة بونفيروني، مما يظهر دقة أعلى بكثير من التدرجات التقريبية عبر مجالات متعددة من المشكلات.

Sohaib Lafifi2026-05-26
💬 NLP

JudgmentBench: Comparing Rubric and Preference Evaluation for Quality Assessment

تقدم هذه الورقة البحثية JudgmentBench، وهو معيار مرجعي جديد لـ 30 مهمة قانونية تم تصنيفها من قبل محامين خبراء باستخدام كل من درجات التقييم وفق معايير محددة والتفضيلات الثنائية، مما يثبت أن الأحكام المقارنة تتفوق بشكل كبير على التسجيل القائم على المعايير في استعادة ترتيب الجودة مع تطلب أقل من نصف وقت التصنيف.

Russell Yang, Ruishi Chen, Pierce Kelaita, Riya Ranjan, Sibo Ma, Charles Dickens, Matthew Guillod, Megan Ma, Julian Nyar (…)2026-05-26
🤖 AI

LipoAgent: Coordinating Fine-Tuned LLM Agents for Safer Lipid Design

يُعد LipoAgent إطار عمل للنماذج اللغوية الكبيرة متعددة الوكلاء والواعية بالسلامة، والذي يدمج الضبط الدقيق الخاص بالمجال مع التنبؤ الشرطي والإشراف البشري لإعطاء الأولوية لقيود السمية، محققاً تحسناً بنسبة 32% في التنبؤ بكفاءة ترانسفكشن (transfection) لـ mRNA ونتائج بيولوجية موثقة لتصميم الجسيمات النانوية الدهنية.

Leshu Li, An Lu, Haiyu Wang, Zhibin Feng, Conghui Duan, Qing Bao, Zongmin Zhao, Sai Qian Zhang2026-05-26
🤖 AI

Whose Alignment? Comparing LLM Process Alignment Across Diverse Organizational Decision Contexts

تجادل هذه الورقة بأن مواءمة النماذج اللغوية الكبيرة مع اتخاذ القرار التنظيمي تتطلب قياس مواءمة العملية (كيفية وزن المعلومات) بدلاً من مجرد الاتفاق على المخرجات، وتبرهن من خلال دراسات حالة متباينة أنه بينما تتنبأ مواءمة العملية بالدقة في السياقات القانونية، فإنها قد ترمز إلى أنماط تمييزية في المجالات المتنازع عليها مثل الائتمان الاستهلاكي، مما يكشف عن الطبيعة التعددية للمواءمة التنظيمية.

Niklas Weller, Emilio Barkett2026-05-26
🤖 machine learning

Latent Q-Barrier Shielding for Safe In-Context Reinforcement Learning

تقترح هذه الورقة إطار عمل "درع حاجز كوامن" (Latent Q-Barrier Shielding) يعزز التعلم التعزيزي السياقي الآمن في ظل تحولات خارج نطاق التوزيع من خلال استنتاج السياق وتصفية الإجراءات بناءً على التكاليف المستقبلية المتوقعة وميزانيات السلامة المتبقية دون الحاجة إلى تحديثات للمعلمات في وقت الاختبار، مما يحقق مقايضات متفوقة بين المكافأة والسلامة عبر معايير متعددة.

Minjae Kwon, Amir Moeini, Shangtong Zhang, Lu Feng2026-05-26
🔢 mathematics

Positivity in classical enumerative geometry: a case study in synchronized AI-assisted mathematics

تحل هذه الورقة فرضيات طال أمدها وتؤسس لنتائج جديدة حول الإيجابية والتقعر اللوغاريتمي لفصول تشيرن في الهندسة التعدادية الكلاسيكية من خلال ريادة سير عمل تنسيقي مبتكر يدمج بين أنظمة ذكاء اصطناعي متعددة مع البصيرة الرياضية البشرية.

Gergely Bérczi, László M. Fehér2026-05-26
🤖 AI

Neuromorphic LiDAR-based Bird's Eye View Object Detection using Energy-efficient Spiking Neural Networks

تقترح هذه الورقة شبكة عصبية نبضية (spiking neural network) من طرف إلى طرف للكشف عن الأجسام من منظور عين الطائر القائم على تقنية ليدار (LiDAR)، والتي تحقق دقة عالية في معيار KITTI مع تقليل استهلاك الطاقة بشكل كبير مقارنة بالشبكات العصبية الالتفافية التقليدية، مما يثبت جدوى الإدراك العصبي الفعال للقيادة الذاتية.

Sambit Mohapatra, Senthil Yogamani, Heinrich Gotzig, Patrick Mader2026-05-26