🤖 AI

GroupAffect-4: A Multimodal Dataset of Four-Person Collaborative Interaction

تقدم هذه الورقة البحثية GroupAffect-4، وهي مجموعة بيانات شاملة متعددة الوسائط لـ 40 مشاركاً في عشر مجموعات مكونة من أربعة أشخاص يؤدون مهام تعاونية متنوعة، والتي تدمج البيانات الفسيولوجية، وتتبع حركة العين، والصوت، والتقارير الذاتية المتزامنة لتمكين تحليل العاطفة عبر المستويات الفردية، وبين الأشخاص، والمستويات الجماعية.

Meisam Jamshidi Seikavandi, Alice Modica, Anna Obara, Shan Ahmed Shaffi, Fabricio Batista Narcizo, Tanya Ignatenko, Ted (…)2026-05-20
🤖 machine learning

AR1-ZO: Topology-Aware Rank-1 Zeroth-Order Queries for High-Rank LoRA Fine-Tuning

تقدم هذه الورقة AR1-ZO، وهي طريقة تحسين من الدرجة صفر واعية بالطوبولوجيا تعالج مفارقة الرتبة في الضبط الدقيق لـ LoRA عالي الرتبة عبر استعلام الذرات الفردية من الرتبة-1 باستخدام عامل قياس مصحح، مما يؤدي إلى استعادة قوة الإشارة وتمكين التدريب الفعال الموفر للذاكرة دون قواعد مساعدة أو عمليات تمرير أمامي إضافية.

Ziye Chen, Hongbin Lin, Chenyu Zhang, Xiangda Yan, Yongjie Yang, Yao Shu2026-05-20
🤖 AI

OpenComputer: Verifiable Software Worlds for Computer-Use Agents

تقدم الورقة البحثية OpenComputer، وهو إطار عمل قائم على التحقق يبني عوالم برمجية قابلة للتحقق لوكلاء استخدام الكمبيوتر من خلال دمج أدوات تحقق من الحالة خاصة بالتطبيقات، وطبقة تحقق ذاتية التطور، ومسار لتوليد المهام، وهيكل تقييم للكشف عن فجوات كبيرة في متانة الوكلاء الحاليين، سواء الرائدة أو مفتوحة المصدر، رغم تقدمهم الجزئي.

Jinbiao Wei, Qianran Ma, Yilun Zhao, Xiao Zhou, Kangqi Ni, Guo Gan, Arman Cohan2026-05-20
🤖 AI

Distribution-Free Uncertainty Quantification for Continuous AI Agent Evaluation

تقدم هذه الورقة إطار عمل خالٍ من التوزيع للتقييم المستمر لوكلاء الذكاء الاصطناعي، والذي يوفر التنبؤ المطابق والاستدلال المطابق التكيفي لتوفير فترات عدم يقين معايرة، وحدود تركيبية لخطوط أنابيب الوكلاء المتعددين، وقواعد امتناع محكومة للتصنيفات، مما يثبت أداءً قويًا عبر 50 وكيلًا و18 إشارة في الوقت الفعلي.

Yuxuan Gao, Megan Wang, Yi Ling Yu2026-05-20
🤖 AI

Prior Knowledge or Search? A Study of LLM Agents in Hardware-Aware Code Optimization

تُظهر هذه الدراسة أن وكلاء النماذج اللغوية الكبيرة في تحسين الكود البرمجي المراعي لخصائص الأجهزة يعتمدون بشكل أساسي على الأوليات المدربة مسبقاً بدلاً من التغذية الراجعة التكرارية أو الهياكل الوكيلية، كما يتضح من سلوكهم الجشع في الإعدادات الصندوقية السوداء، وعدم قدرتهم على التكيف مع أحجام النواة غير المرئية، وتدهور الأداء عند العمل مع تمثيلات وسيطة منخفضة الكثافة.

Dmitry Redko (Applied AI Institute), Albert Fazlyev (AI Talent Hub, ITMO University), Konstantin Sozykin (Applied AI Ins (…)2026-05-20
🤖 AI

AffectAI-Capture: A Reproducible Multimodal Protocol for Small-Group Meeting Research

تقدم هذه الورقة AffectAI-Capture، وهو بروتوكول متعدد الوسائط قابل لإعادة الإنتاج مصمم لجمع بيانات متزامنة من اجتماعات تضم أربعة أشخاص باستخدام مستشعرات متنوعة مثل تتبع حركة العين والأجهزة القابلة للارتداء، ومنظم حول جدول زمني موحد للأحداث لدعم الأبحاث العاطفية والسلوكية.

Meisam Jamshidi Seikavandi, Alice Modica, Anna Obara, Fabricio Batista Narcizo, Tanya Ignatenko, Ted Vucurevich, Jesper (…)2026-05-20
🤖 AI

Stitched Value Model for Diffusion Alignment

يقدم البحث إطار عمل StitchVM، وهو إطار عمل لدمج النماذج خفيف الوزن يقوم بنقل نماذج المكافأة مسبقة التدريب من فضاء البكسل بكفاءة إلى الفضاءات الكامنة المشوشة عبر إلحاق عمود فقري لنموذج انتشار مجمد، مما يتيح محاذاة دقيقة وفعالة حاسوبياً لنماذج الانتشار دون التحيز لتقديرات "توييدي" (Tweedie) أو التكلفة العالية لعمليات "مونت كارلو" المتكررة (Monte Carlo rollouts).

Hyojun Go, Hyungjin Chung, Prune Truong, Goutam Bhat, Li Mi, Zhaochong An, Zixiang Zhao, Dominik Narnhofer, Serge Belong (…)2026-05-20
💬 NLP

Chunking German Legal Code

تُثبت هذه الورقة البحثية أنه بالنسبة لعمليات التوليد المعزز بالاسترجاع على القانون التشريعي الألماني، فإن استراتيجيات تقسيم النصوص التي تتماشى مع الوحدات الهيكلية المتأصلة في المستند (مثل الأقسام والفقرات الفرعية) تتفوق على الأساليب الدلالية أو الهرمية الأكثر تعقيداً من خلال تحقيق استدعاء أعلى بكفاءة حوسبية أكبر.

Max Prior, Natalia Milanova, Andreas Schultz2026-05-20
📊 statistics

FLUXtrapolation: A benchmark on extrapolating ecosystem fluxes

تقدم الورقة البحثية FLUXtrapolation، وهو معيار مرجعي جديد صُمم لتقييم قدرة نماذج تعلم الآلة على الاستقراء الخارجي لتدفقات النظم البيئية في ظل تحولات توزيع تزداد صعوبة، مما يعالج التحدي الحاسم المتمثل في رفع مقاييس قياسات الأبراج المتفرقة بدقة إلى مستويات عالمية.

Anya Fries, Jacob A Nelson, Martin Jung, Markus Reichstein, Jonas Peters2026-05-20
💬 NLP

LP-Eval: Rubric and Dataset for Measuring the Quality of Legal Proposition Generation

تقدم هذه الورقة LP-Eval، وهو معيار تقييم ومجموعة بيانات صُمما معاً بالتعاون مع خبراء قانونيين لتقييم جودة المقترحات القانونية التي تولدها النماذج اللغوية الكبيرة من قرارات محكمة الاتحاد الأوروبي، مما يكشف أنه بينما تنتج النماذج مخرجات عالية الجودة بشكل عام، إلا أن أداءها يتفاوت باختلاف عمر القضية، وأن المقيمين من النماذج اللغوية الكبيرة الموجهين بمعايير التقييم، رغم كونهم أفضل من التقييم المباشر، لا يزالون يفتقرون إلى الحساسية الدقيقة التي يتمتع بها الخبراء البشريون.

Shanshan Xu, Johan Lindholm, Amogh Raina, Henrik Palmer Olsen, Daniel Hershcovich2026-05-20