🤖 AI

Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems

تقدم هذه الورقة البحثية نظام "التركيب الاستقرائي الاستنباطي" (IDS)، وهو نظام لغوي كبير وكيل يقوم بتوليد التنفيذات والبراهين الصورية للأنظمة الموزعة بشكل مشترك، محققاً نسبة نجاح بلغت 100% في مواصفات مخازن القيم المفتاحية مع تقليل الوقت والتكلفة بشكل كبير مقارنة بكل من الخبراء البشريين ووكلاء البرمجة الأكثر تطوراً.

Shubham Agarwal, Alexander Krentsel, Shu Liu, Mert Cemri, Audrey Cheng, Rui Meng, Tomas Pfister, Chun-Liang Li, Sylvia R (…)2026-05-25
🤖 AI

Defining AI Fatigue in Academic Contexts: Dimensions, Indicators, and a Stage-Based Model Using Grounded Theory

من خلال تحليل النظرية المجذرة لـ 1,054 طالباً جامعياً في الفلبين، تُعرف هذه الدراسة "إجهاد الذكاء الاصطناعي" كشكل متميز من الإجهاد الأكاديمي يتميز بخمسة أبعاد (الحمل المعرفي الزائد، والانفصال التحفيزي، وعدم الارتياح الأخلاقي، والإجهاد البدني، وتشتت الانتباه)، وتقترح نموذجاً قائماً على المراحل لتفسير كيفية تراكم هذه الضغوط أثناء الاستخدام المستمر لأدوات الذكاء الاصطناعي.

John Paul P. Miranda, Emmanuel B. Parreño, Jovita G. Rivera2026-05-25
🤖 machine learning

Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness

تقدم هذه الورقة أول تنفيذ لإثبات المفهوم لوكيل تعلم تعزيزي "تحت-بايزي" (infra-Bayesian) يتفوق على التعلم التعزيزي الكلاسيكي في متانة الحالة الأسوأ من خلال التعامل بفعالية مع عدم اليقين "النايتي" (Knightian uncertainty) وعدم دقة النموذج عبر عملية اتخاذ قرار "ماكسيمين" (maximin).

Manish Aryal, Faiyaz Azam, Agnivo Banerjee, Sai Sidhanth Manoharan Jayanthi, Allegra Laro, Clément Legentilhomme, Andrew (…)2026-05-25
💬 NLP

As X, Do Y: How Persona and Task Combine in Instruction-Tuned LLMs

بينما تُظهر هذه الورقة أن تعليمات الشخصية والمهمة في النماذج اللغوية الكبيرة المضبوطة بالتعليمات تُظهر تفكيكاً خطياً جمعياً واضحاً عند الانتقال من المطالبة إلى الإجابة في المجرى المتبقي، إلا أنها تثبت في النهاية أن هذه الجمعية المحلية لا تُمكّن من ضغط مطالبات الدور في متجه واحد مخزن مؤقتاً لأن التوليد المشروط بالشخصية يعتمد على آلية انتباه موزعة لا يمكن محاكاتها عن طريق الاستبدال المحلي للمجرى المتبقي.

Eric Xu2026-05-25
💰 quantitative finance

Generative AI and the Reorganization of Labor Demand

باستخدام قاعدة بيانات وطنية لإعلانات الوظائف في الولايات المتحدة ومسار عمل مبتكر لنماذج لغوية كبيرة، تجد هذه الورقة أن الشركات تتكيف مع الذكاء الاصطناعي التوليدي من خلال عملية ديناميكية من إعادة التشكيل التنظيمي، وذلك أساساً عبر إعادة تخصيص الطلب على العمالة عبر الوظائف (52%) وثانوياً من خلال إعادة تصميم المهام داخل الوظائف (39.5%)، مع تباين أنماط التعديل بشكل كبير حسب مستوى الأقدمية.

Fangyan Wang, Zaiyan Wei, Yang Wang2026-05-25
💬 NLP

Autonomous Frontier-Based Exploration with VLM Guidance

تقدم هذه الورقة مسار استكشاف ذاتي خفيف الوزن وخالٍ من التدريب، يستفيد من النماذج اللغوية الرؤيوية للقيام باتخاذ قرارات استراتيجية عالية المستوى من خلال تحليل المطالبات متعددة الوسائط للخرائط والصور المرئية، مما يؤدي إلى تحسين تغطية الخرائط بنسبة تصل إلى 24% مقارنة بالطرق الهندسية الاستدلالية الحالية في البيئات غير المعروفة.

Aarush Aitha, Avideh Zakhor2026-05-25
🤖 AI

PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs

تقدم هذه الورقة البحثية PoisonForge، وهو معيار مرجعي يوضح أن تسميم البيانات على مستوى المهام باستخدام 1% فقط من الأمثلة المصممة يمكن أن ينجح في إجبار النماذج اللغوية الكبيرة المضبوطة بالتعليمات على تضمين كيانات محددة من قبل المهاجم في مخرجات المهام المستهدفة مع الحفاظ على الأداء الطبيعي في مجالات أخرى، مما يكشف أن خيارات تصميم التسميم وليس حجم النموذج هي المحركات الأساسية لنجاح الهجوم.

Luze Sun, Anshuman Suri, Harsh Chaudhari, Cristina Nita-Rotaru, Alina Oprea2026-05-25
💬 NLP

Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks

تكشف هذه الورقة عن فجوة حرجة في معايير تقييم الاستدلال في السياقات الطويلة من خلال إثبات أن التقييمات السائدة تفشل في ضبط موضع المهمة، مما يؤدي إلى انخفاض كبير في الأداء عندما توضع المهام في منتصف السياقات الطويلة بسبب تداخل الحشو، وتقترح إطار عمل تقييم تعفن السياق (CRE) لمعالجة هذه النقطة العمياء الهيكلية.

Chuyifei Zhang, Hongyu Cui, Xiaowen Huang, Jitao Sang2026-05-25
🤖 AI

Lipschitz Optimization for Formal Verification of Homographies

تقدم هذه الورقة إطار عمل للتحقق الرسمي يستنتج حدوداً خطية محكمة لقيم البكسل تحت اضطرابات حركة الكاميرا ثلاثية الأبعاد من خلال الاستفادة من تحسين ليبشيتز والاستمرارية الجزئية للتحويلات الهوموجرافية، مما يتيح أول ضمانات متينة وصارمة لمتانة الشبكات الرؤيوية في المشاهد المستوية دون الاعتماد على عمليات محاكاة معقدة أو نماذج بديلة.

Jean-Guillaume Durand, Panagiotis Kouvaros, Maxime Gariel, Alessio Lomuscio2026-05-25
🤖 AI

GENSTRAT: Toward a Science of Strategic Reasoning in Large Language Models

تقدم هذه الورقة GENSTRAT، وهو إطار عمل يستخدم بيئات استراتيجية مُولدة إجرائياً وملف تعريف قدرات متعدد المحاور لتقييم التفكير الاستراتيجي للنماذج اللغوية الكبيرة، مما يكشف أن النماذج ذات الأداء العام المتشابه يمكن أن تُظهر نقاط قوة متميزة وتقلبات سلوكية غير متوقعة في سيناريوهات محددة ذات صلة بالنشر.

Vartan Shadarevian, Kia Ghods, Alex Kenich, Anany Kotawala2026-05-25