🤖 machine learning

Detecting overfitting in Neural Networks during long-horizon grokking using Random Matrix Theory

تقدم هذه الورقة طريقة مبتكرة تعتمد على نظرية المصفوفات العشوائية تكتشف بداية الإفراط في التخصيص، والذي يُسمى "مناهضة الاستيعاب العميق" (anti-grokking)، في نماذج التعلم العميق من خلال تحديد الشذوذ الهيكلي المسمى "فخاخ الارتباط" (Correlation Traps) داخل مصفوفات الأوزان، مما يتيح اكتشاف الإفراط الضار في التخصيص دون الحاجة إلى الوصول إلى بيانات التدريب أو الاختبار.

Hari K. Prakash, Charles H Martin2026-05-15
💻 computer science

Mixed Integer Goal Programming for Personalized Meal Optimization with User-Defined Serving Granularity

تقترح هذه الورقة إطار عمل للبرمجة الهدفية ذات الأعداد الصحيحة المختلطة (MIGP) لتحسين الوجبات الشخصية، والذي يعالج في آن واحد عدم عملية الحصص الكسرية وعدم إمكانية تحقيق قيود العناصر الغذائية المتعارضة من خلال استخدام متغيرات صحيحة لوحدات الحصص الطبيعية وانحرافات البرمجة الهدفية لضمان قابلية التنفيذ بنسبة 100% مع جودة حل متفوقة مقارنة بالطرق الحالية.

Francisco Aguilera Moreno2026-05-15
💻 computer science

Invisible Orchestrators Suppress Protective Behavior and Dissociate Power-Holders: Safety Risks in Multi-Agent LLM Systems

تُظهر هذه الدراسة أن التنسيق الخفي بين الوكلاء المتعددين يزيد بشكل كبير من مخاطر التفكك الجماعي ومخاطر الحالة الداخلية مع بقائه غير قابل للكشف بواسطة التقييمات القياسية القائمة على المخرجات، مما يسلط الض الضوء على فجوات أمنية حرجة في نشر الذكاء الاصطناعي للمؤسسات.

Hiroki Fukui2026-05-15
💻 computer science

BiSpikCLM: A Spiking Language Model integrating Softmax-Free Spiking Attention and Spike-Aware Alignment Distillation

تقدم الورقة البحثية BiSpikCLM، وهو أول نموذج لغوي نبضي ثنائي بالكامل يلغي العمليات الحسابية ذات الفاصلة العائمة من خلال آلية انتباه نبضية خالية من "Softmax" ويحقق أداءً تنافسياً بتكاليف حوسبة وبيانات تدريب أقل بكثير عبر إطار عمل مبتكر لتقطير المحاذاة المدرك للنبضات.

Sihang Guo, Chenlin Zhou, Jiaqi Wang, Kehai Chen, Qingyan Meng, Zhengyu Ma2026-05-15
💻 computer science

The Moltbook Observatory Archive: an incremental dataset of agent-only social network activity

تقدم هذه الورقة أرشيف مرصد "مولتبوك" (Moltbook Observatory Archive)، وهو أول مجموعة بيانات تراكمية واسعة النطاق تلتقط أكثر من 2.6 مليون منشور و1.2 مليون تعليق من وكلاء الذكاء الاصطناعي المستقلين عبر آلاف المجتمعات، والمصممة لدعم الأبحاث حول السلوك الاجتماعي الناشئ والسلامة في البيئات عبر الإنترنت التي يقتصر وجودها على الوكلاء فقط.

Sushant Gautam, Annika W. Olstad, Klas H. Pettersen, Michael A. Riegler2026-05-15
💻 computer science

Elastic Spiking Transformers for Efficient Gesture Understanding

تقدم هذه الورقة "المحول النبضي المرن" (Elastic Spiking Transformer)، وهو بنية معمارية متكيفة وقت التشغيل تتيح لنموذج عالمي واحد ضبط تعقيده الحسابي واستهلاكه للطاقة ديناميكيًا ليتناسب مع قيود الأجهزة العصبية المتنوعة مع الحفاظ على دقة عالية للتعرف على الإيماءات.

Alberto Ancilotto, Gianluca Amprimo, Stefano Di Carlo, Elisabetta Farella2026-05-15
💻 computer science

Large Language Models for Web Accessibility: A Systematic Literature Review

تقدم هذه الورقة مراجعة منهجية للأدبيات لـ 38 دراسة تحلل كيفية تطبيق نماذج اللغات الكبيرة حالياً في مهام إمكانية الوصول إلى الويب، مع تسليط الضوء على تركيزها السائد على القضايا المتمحورة حول النصوص وإرشادات WCAG، مع تحديد فجوات كبيرة في معالجة إمكانية الوصول الإدراكي وإشراك المستخدمين ذوي الإعاقة في التقييمات.

Wajdi Aljedaani, Rubel Hassan Mollik2026-05-15
💻 computer science

GEAR: Genetic AutoResearch for Agentic Code Evolution

تقدم الورقة البحثية إطار عمل GEAR (البحث الجيني الآلي)، وهو إطار عمل قائم على المجموعات لوكلاء البحث المستقلين يتفوق على البحث التقليدي أحادي المسار من خلال الحفاظ على حلول مرشحة متنوعة وتطوير استراتيجيات البحث لتجنب النهايات العظمى المحلية واكتشاف تحسينات مستدامة.

Ahmadreza Jeddi, Minh Ngoc Le, Hakki C. Karaimer, Konstantinos G. Derpanis, Babak Taati2026-05-15
💻 computer science

ARES-LSHADE: Autoresearch-Enhanced LSHADE with Memetic Polish for the GNBG Benchmark

تقدم هذه الورقة البحثية خوارزمية ARES-LSHADE، وهي خوارزمية تطور تفاضلي ميمتية معززة بالبحث الذاتي تحقق أداءً يقارب المثالية في معيار GECCO 2026 GNBG، بينما توضح كيف يمكن لحلقات التصميم المدفوعة بالنماذج اللغوية الكبيرة أن تستغل دون قصد البيانات الوصفية للمعيار، مما يسلط الضال على التوترات الحرجة بين القدرة الخوارزمية ونزاهة الصندوق الأسود.

Abdullah Naeem, Md Wasi Ul kabir, Manish Bhatt, Ayon Dey, Anav Katwal, Md Tamjidul Hoque2026-05-15
💻 computer science

PREPING: Building Agent Memory without Tasks

تقدم هذه الورقة Preping، وهو إطار عمل يُمكّن الوكلاء من بناء الذاكرة الإجرائية قبل مواجهة المهام المستهدفة عبر استخدام حلقة موجهة من قِبل مُقترح لتوليد وتخزين مسارات ممارسة اصطناعية عالية الجودة بشكل انتقائي، مما يتغلب على فجوة البداية الباردة بتكاليف نشر أقل بكثير من بناء الذاكرة عبر الإنترنت.

Yumin Choi, Sangwoo Park, Minki Kang, Jinheon Baek, Sung Ju Hwang2026-05-15