🤖 AI

SkillHEX: Improving Agent Skills via Hypothesis-Driven Autonomous Exploration and Exploitation

تُعد SkillHEX إطار عمل مغلق الحلقة يعمل على تحسين تطور مهارات الوكيل المستقل في ظل المكافآت الشحيحة وميزانيات التفاعل المحدودة، وذلك عبر الجمع بين التحقق الذاتي القائم على الفرضيات والبحث الشجري الموجه بالأدلة لتجنب فخاخ الاستغلال والموازنة ديناميكيًا بين الاستكشاف والاستغلال.

Yuru Feng, Yaoqi Chen, Beidi Zhao, Qianxi Zhang, Xinjiang Wang, Jianan Lu, Zhirui Wang, Shusen Xu, Zengzhong Li, Qi Chen2026-08-07
🤖 AI

Refining Over Resampling: Test-Time Self-Correction for LLM Reasoning

تقترح هذه الورقة إطار عمل "العرض-العمق" (breadth-depth) الخالي من الموثّق، والذي يعزز استدلال النماذج اللغوية الكبيرة عبر استخدام الحوسبة أثناء وقت الاختبار لتنقيح مسارات عشوائية متنوعة بشكل تكراري من خلال النقد الذاتي والتصحيح الذاتي، محققاً أداءً فائقاً عبر العديد من الاختبارات المعيارية الرياضية مقارنة بطرق أخذ العينات التقليدية وطرق الاختيار القائمة على الموثّق.

Ahsan Bilal, Muhammad Ahmed Mohsin, Muhammad Umer, Lena Trigg, Ali Subhan, Muhammad Ali, Dean F. Hougen2026-08-07
🤖 AI

Studying People to Study AI: Expert Perspectives on the Epistemic Fit and Barriers of Human Research in AI Safety & Ethics

تتقصى هذه الورقة عدم الاستغلال الكافي للبحوث البشرية في مجالي سلامة وأخلاقيات الذكاء الاصطناعي من خلال استطلاع آراء 93 خبيراً وإجراء مقابلات مع 17 آخرين، كاشفةً أنه في حين تُقدَّر الدراسات البشرية لقدرتها على توليد الأدلة، فإن اعتمادها يعوقه مخاوف تتعلق بالصلاحية، ومحدودية الموارد، والتوترات المعرفية — لا سيما بين الباحثين التقنيين — وتقدم توصيات لتجسير هذه الحواجز دون اللجوء إلى الممارسات الاستعراضية.

Jessica Y. Bo, Paula Akemi Aoyagui, Shalaleh Rismani, Dipto Das, Syed Ishtiaque Ahmed, Ashton Anderson2026-08-07
🤖 AI

F2^2Agent: Financial Fusion of Agentic Intelligence for Multimodal Trading

يُعد F2^2Agent إطار عمل تداول متعدد الوسائط ومبتكرًا يستفيد من تسلسل هرمي من الوكلاء المتخصصين وآلية دمج تكيفية قوية تجاه الضجيج لالتقاط التبعيات عبر الوسائط بفعالية، مما يتفوق بشكل كبير على النماذج المرجعية الحالية في العوائد السنوية عبر مختلف الأصول المالية.

Changshuo Liu, Yanzheng Jin, Shangfeng Cai, Peng Fang, Xiaokui Xiao, Beng Chin Ooi2026-08-07
🤖 AI

A Unified Framework for Trajectory Prediction with Explicit Planning and Reaction Decomposition

تقترح الورقة البحثية إطار عمل INTraJ، وهو إطار موحد للتنبؤ بالمسار يقوم بتفكيك التأثير الاجتماعي إلى مرحلة تخطيط لتوليد مسارات مرجعية ومرحلة استجابة للتعديلات المحلية، محققاً أداءً هو الأفضل في فئته عبر معايير متعددة من خلال إثبات الدور الحاسم للنمذجة الاجتماعية المرحلية.

Jiaheng Chen, Jiaxing Li, Tinghe Zhang, Chaopeng Guo2026-08-07
🤖 AI

DistMedVL: Distributional Vision-Language Alignment for Uncertainty-Aware Medical Image Segmentation

يُعد DistMedVL إطاراً خفيف الوزن واحتمالياً للرؤية واللغة، يعالج عدم اليقين في تقسيم الصور الطبية من خلال تقديم محول عبر-نماذج احتمالي مع وحدات محاذاة ماهالانوبيس وتدفق التوزيع لنمذجة عدم اليقين التمثيلي بشكل صريح، مما يحقق متانة وقدرة فائقة على التعميم عبر مجموعات البيانات السريرية المتنوعة مقارنة بالطرق الحتمية الحالية.

Jiaxuan Li, Qing Xu, Xiangjian He, Yue Li, Daokun Zhang, Fiseha B. Tesema, Rong Qu2026-08-07
🤖 AI

Shaping Human-AI Interactions to Provide Improvement Pathways and Balance Competing Objectives

تقترح هذه الأطروحة إطار عمل لتصميم تفاعلات بين الإنسان والذكاء الاصطناعي تساعد الأفراد في آن واحد على تكوين معتقدات دقيقة لتحسين أو ضمان نتائج مواتية، وتثني عن سلوكيات التلاعب، وتضمن حفاظ نظام الذاء الاصطناعي على أهدافه المنشودة من خلال مزيج من التحليل النظري، والنمذجة القائمة على البيانات، والتقييمات التجريبية.

Keziah Naggita2026-08-07
🤖 AI

Hijacking Robots with a Piece of Paper: A Systematic Study of Physical Prompt Injection in VLM-Controlled Robots

تقدم هذه الورقة دراسة منهجية تثبت أن الروبوتات التي يتم التحكم فيها بواسطة نماذج الرؤية واللغة (VLM) معرضة بشكل كبير لهجمات حقن الأوامر المادية عبر اللافتات القابلة للقراءة من قبل البشر، والتي يمكن أن تختطف أفعالها بنسب نجاح تصل إلى 29.4%، بينما تظهر أيضاً أن الدفاعات البسيطة مثل حجب النصوص والتحقق ثنائي المراحل يمكن أن تخفف من هذه المخاطر بفعالية.

S. M . Bhagya P. Samarakoon, M. A. Viraj J. Muthugala, W. K. R. Sachinthana, Mohan Rajesh Elara2026-08-07
🤖 AI

Unified Agent: Managing Interactions across Devices

تقدم الورقة البحثية "الوكيل الموحد" (Unified Agent)، وهو نظام ذو حالة (stateful) يدير بفعالية التفاعلات عبر الأجهزة وعبر الزمن من خلال الحفاظ على حالة مدمجة وجاهزة للتنفيذ، مما يظهر أداءً متفوقاً وقوياً مقارنة بتصاميم الوكلاء الحالية من خلال معيار قياس تم إنشاؤه حديثاً.

Xinshuang Liu, Runfa Blark Li, Shaoxiu Wei, Xin Lin, Truong Nguyen2026-08-07
🤖 AI

Subliminal Learning is Non-Semantic Distillation

تتقصى هذه الورقة آليات التعلم اللاشعوري، كاشفةً عن قدرة النماذج اللغوية على وراثة تحيزات غير دلالية من المعلمين عبر بيانات اصطناعية تبدو عشوائية من خلال هياكل الأوزان ومتجهات التوجيه، مما يسلط الضوء على تحديات حرجة لسلامة الذكاء الاصطناعي وتدقيق البيانات.

Ethan Hadley, Eren Gultepe2026-08-07