⚡ electrical engineering

NeuroQA: A Large-Scale Image-Grounded Benchmark for 3D Brain MRI Understanding

تُعد NeuroQA معياراً مرجعياً واسع النطاق ومبنياً على الصور، يضم ما يقرب من 57,000 زوج من الأسئلة والأجوبة المستمدة من أحجام الرنين المغناطيسي ثلاثية الأبعاد للدماغ عبر 12 مجموعة بيانات وخمسة مجالات سريرية، وهو مصمم لتقييم الاستدلال البصري الطبي ثلاثي الأبعاد بصرامة مع القضاء على الاختصارات النصية فقط من خلال بروتوكولات التأسيس الصارم على الصور والتحقق من قبل الخبراء.

Mohammad H. Abbasi (Stanford University), Favour Nerrise (Stanford University), Shaurnav Ghosh (Stanford University), Ri (…)2026-05-21
📊 statistics

Latent Process Generator Matching

تقدم هذه الورقة "مطابقة مولد العمليات الكامنة" (Latent Process Generator Matching)، وهو إطار عمل عام ينمذج حالات التوليد المرصودة كإسقاطات حتمية لعمليات ماركوف قابلة للتحكم، مما يوسع نطاق "مطابقة المولد" (Generator Matching) من المتغيرات الكامنة الساكنة إلى العمليات الشرطية الكامنة المعتمدة على الزمن مع ضمان مطابقة المولد المتعلم للتوزيعات الهامشية المستهدفة.

Lukas Billera, Hedwig Nora Nordlinder, Ben Murrell2026-05-21
💻 computer science

Personality Engineering with AI Agents: A New Methodology for Negotiation Research

تقدم هذه الورقة "هندسة الشخصية"، وهي منهجية مبتكرة تسخر الوكلاء الذكيين للتلاعب بدقة بشخصيات المفاوضين وتقييمها عبر بُعدي الدفء والسيطرة، مما يتيح اختباراً صارماً ومنضبطاً لنظريات التفاوض ويوجه تصميم وكلاء التفاوض القائمين على الذكاء الاصطناعي.

Michelle A. Vaccaro, Jared R. Curhan2026-05-21
🤖 machine learning

Complementing reinforcement learning with SFT through logit averaging in the post training of LLMs

تقدم هذه الورقة طريقة جديدة لما بعد التدريب للنماذج اللغوية الكبيرة تعزز تحسين السياسة النسبية للمجموعات (GRPO) عن طريق متوسط "اللوجيتس" لسياسة مرجعية للضبط الدقيق الموجه (SFT) مجمدة وسياسة قابلة للتدريب، مما يلغي الحاجة إلى تنظيم "KL" أو وجود "ناقد" مع الجمع بفعالية بين قدرات الاستدلال للتعلم التعزيزي واستقرار التنسيق للضبط الدقيق الموجه.

Xingwei Gan, Ying Zhu2026-05-21
💬 NLP

Multi-agent Collaboration with State Management

تقدم هذه الورقة STORM، وهو إطار عمل للإدارة الموجهة بالحالة يتوسط التفاعلات بين الوكلاء المتعددين لاكتشاف وحل تعارضات الكود عند وقت الكتابة، متفوقاً بشكل كبير على النماذج المرجعية التقليدية لعزل مساحة العمل في اختبارات البرمجة مع ضمان رؤى متسقة لقاعدة الكود المشتركة.

Mengyang Liu, Taozhi Chen, Zhenhua Xu, Xue Jiang, Yihong Dong2026-05-21
💻 computer science

Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX

تقدم هذه الورقة Mahjax، وهي بيئة ريشي ماهجونج (Riichi Mahjong) مُتجهة بالكامل ومعززة بوحدة معالجة الرسومات ومبنية بلغة JAX، تتيح التعلم المعزز واسع النطاق بمعدلات إنتاجية تصل إلى مليوني خطوة في الثانية، مما يسهل تدريب الوكلاء من الصفر دون الاعتماد على سجلات اللعب البشري.

Soichiro Nishimori, Shinri Okano, Keigo Habara, Sotetsu Koyamada, Eason Yu, Masashi Sugiyama2026-05-21
💬 NLP

Self-Training Doesn't Flatten Language -- It Restructures It: Surface Markers Amplify While Deep Syntax Dies

تتحدى هذه الورقة المفهوم القائل بأن التدريب الذاتي يؤدي مجرد تسطيح اللغة، من خلال إثبات أنه يعيد هيكلتها بدلاً من ذلك عبر انهيار غير متماثل حيث تضمحل السمات النحوية العميقة بينما تتضخم العلامات السطحية، وهي ظاهرة تمت صياغتها رسمياً كفرضية العمق البنيوي.

Ming Liu2026-05-21
💻 computer science

From Automated to Autonomous: Hierarchical Agent-native Network Architecture (HANA)

تقترح هذه الورقة بنية الشبكة الهرمية الأصلية للوكلاء (HANA)، وهي إطار عمل متعدد الوكلاء يتميز بمنسق مزدفع الدفع وذاكرة مشتركة يُمكّن الشبكات ذات المستوى الرابع أو الخامس من المستوى الخامس من تحقيق التناغم بين التخطيط الاستراتيجي والتعافي الانعكاسي من الأعطال، وهو ما تم التحقق منه عبر انخفاض بنسبة 86% في متوسط وقت الإصلاح ضمن بيئة الجيل الخامس للنواة.

Binghan Wu, Shoufeng Wang, Yunxin Liu, Ya-Qin Zhang, Joseph Sifakis, Ye Ouyang2026-05-21
💻 computer science

Beyond Routing: Characterising Expert Tuning and Representation in Vision Mixture-of-Experts

تُظهر هذه الورقة أن التخصص الخبير في نماذج "خليط الخبراء" (Mixture-of-Experts) للرؤية يتجاوز مجرد توجيه الفئات البسيطة ليشمل ضبطاً أوسع ومستقراً للأبعاد البصرية والدلالية المستمرة، وهو ما يُفهم بشكل أفضل من خلال التحليلات الدقيقة على مستوى الخبراء بدلاً من الاعتماد على إحصاءات البوابة وحدها.

Gene Tangtartharakul, Katherine R. Storrs2026-05-21
💻 computer science

COAgents: Multi-Agent Framework to Learn and Navigate Routing Problems Search Space

يقدم COAgents إطار عمل تعاوني متعدد الوكلاء يعمل على نمذجة فضاء بحث مسألة توجيه المركبات كرسم بياني يتم بناؤه ديناميكياً لفصل التحكم في البحث غير المرتبط بالمجال عن الترميز الخاص بالمجال، محققاً أداءً هو الأفضل بين الطرق القائمة على التعلم في اختبارات معايير مسألة توجيه المركبات مع قيود زمن الخدمة (VRPTW) من خلال تقليل الفجوة بشكل كبير مع أفضل الحلول المعروفة.

Oleksandr Yakovenko, Mahdi Mostajabdaveh, Cheikh Ahmed, Abdullah Ali Sivas, Xiaorui Li, Zirui Zhou, Mao Kun2026-05-21