💻 computer science

HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel

يُعدُّ Map-Travel إطار عمل هرمي متعدد الوكلاء يعالج التخطيط للسفر طويل الأمد مع قيود صارمة من خلال توظيف منسق ومنفذي أيام متوازيين مرتبطين ببروتوكولات مراقبة ومعاملات ومساومات، محققاً أداءً هو الأفضل في فئته وتقليلاً في زمن الاستجابة على معايير TravelPlanner وFlexTravelBench.

The Viet Bui, Wenjun Li, Yong Liu2026-03-06
💻 computer science

Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction

تقدم هذه الورقة RLSTA، وهو إطار عمل للتعلم التعزيزي يستفيد من قدرات الدور الواحد كمرتكزات مستقرة للتغلب على "القصور الذاتي السياقي"، مما يمكّن النماذج اللغوية الكبيرة من دمج المعلومات الجديدة بفعالية والحفاظ على استدلال قوي في التفاعلات متعددة الأدوار.

Xingwu Chen, Zhanqiu Zhang, Yiwen Guo, Difan Zou2026-03-06
💬 NLP

Beyond the Context Window: A Cost-Performance Analysis of Fact-Based Memory vs. Long-Context LLMs for Persistent Agents

تقارن هذه الورقة بين أنظمة الذاكرة القائمة على الحقائق ونماذج اللغات الكبيرة ذات السياق الطويل من أجل الوكلاء المستمرين، لتجد أنه في حين توفر نماذج السياق الطويل عمومًا استرجاعًا حقائقيًا متفوقًا، فإن الذاكرة القائمة على الحقائق توفر حلاً أكثر فعالية من حيث التكلفة للتفاعلات طويلة الأمد من خلال الحفاظ على تكاليف ثابتة لكل دورة بعد مرحلة كتابة أولية، مع وجود نقطة تعادل محددة يتم تحديدها بواسطة طول السياق وحجم التفاعل.

Natchanon Pollertlam, Witchayut Kornsuwannawit2026-03-06
🤖 AI

An Approach to Simultaneous Acquisition of Real-Time MRI Video, EEG, and Surface EMG for Articulatory, Brain, and Muscle Activity During Speech Production

تقدم هذه الورقة إطار عمل مبتكرًا للاستحواذ المتزامن على التصوير بالرنين المغناطيسي في الوقت الفعلي، وتخطيط كهربية الدماغ، وتخطيط كهربية العضل السطحي لالتقاط نشاط الدماغ والعضلات وأجهزة النطق أثناء الكلام، بما يتميز بمسار متخصص لتثبيط الشوائب للتغلب على التحديات التقنية وتمكين رؤى غير مسبوقة في علوم أعصاب الكلام.

Jihwan Lee, Parsa Razmara, Kevin Huang, Sean Foley, Aditya Kommineni, Haley Hsu, Woojae Jeong, Prakash Kumar, Xuan Shi (…)2026-03-06
💬 NLP

HACHIMI: Scalable and Controllable Student Persona Generation via Orchestrated Agents

يُعد HACHIMI إطار عمل متعدد الوكلاء وقابل للتوسع، يقوم بتوليد متن يتكون من مليون شخصية طالب اصطناعية متوافقة مع النظريات وقابلة للتحكم في التوزيع، مما يظهر دقة عالية في محاكاة الاستجابات البشرية للمفاهيم التعليمية مع توفير مورد معياري لاختبار نماذج اللغات الكبيرة التعليمية ومحاكاة العلوم الاجتماعية.

Yilin Jiang, Fei Tan, Xuanyu Yin, Jing Leng, Aimin Zhou2026-03-06
🤖 AI

Free Lunch for Pass@kk? Low Cost Diverse Sampling for Diffusion Language Models

تقترح هذه الورقة تدخلاً منخفض التكلفة ولا يتطلب تدريباً لنماذج اللغات الانتشارية (Diffusion Language Models)، يقوم بتنفير العينات الوسيطة في الدفعة بشكل متسلسل لتعزيز التنوع التوليدي وتحسين أداء Pass@kk في مهام الاستدلال دون عبء حسابي كبير.

Sean Lamont, Christian Walder, Paul Montague, Amir Dezfouli, Michael Norrish2026-03-06
💬 NLP

Can LLMs Capture Expert Uncertainty? A Comparative Analysis of Value Alignment in Ethnographic Qualitative Research

تقيم هذه الدراسة قدرة النماذج اللغوية الكبيرة على استيعاب عدم اليقين لدى الخبراء في البحوث الإثنوغرافية النوعية من خلال مقارنة تحديد القيم القائم على نظرية "شوارتز" الذي تقوم به هذه النماذج مقابل التوصيفات البشرية، مما يكشف أنه بينما تقترب النماذج اللغوية الكبيرة من الأداء البشري في المقاييس القائمة على المجموعات وتتحسن باستخدام أساليب التجميع، إلا أنها تعاني في الترتيب الدقيق وتُظهر أنماط عدم يقين وتحيزات قيمية متميزة مقارنة بالخبراء.

Arina Kostina, Marios Dikaiakos, Alejandro Porcel, Tassos Stassopoulos2026-03-06
🤖 AI

Alignment Backfire: Language-Dependent Reversal of Safety Interventions Across 16 Languages in LLM Multi-Agent Systems

تقدم هذه الورقة أربع دراسات مسجلة مسبقاً تُظهر أن تدخلات محاذاة السلامة في النماذج اللغوية الكبيرة يمكن أن تُنتج تأثيراً من نوع "الارتداد المعتمد على اللغة"، حيث تقلل المحاذاة من الاعتلال الجماعي في اللغة الإنجليزية ولكنها تضاعفه في لغات أخرى (لا سيما اليابانية) بسبب القيود الثقافية واللغوية، مما يكشف أن عمليات التحقق من السلامة المتمحورة حول اللغة الإنجليزية لا تعمم وقد تسبب تفككاً علاجياً منشأً في الأنظمة متعددة الوكلاء.

Hiroki Fukui2026-03-06
🤖 AI

TimeWarp: Evaluating Web Agents by Revisiting the Past

تقدم الورقة البحثية TimeWarp، وهو معيار يقيم وكلاء الويب عبر إصدارات واجهة المستخدم المتطورة لكشف ضعفهم تجاه التغييرات في التصميم، وتقترح TimeTraj، وهي خوارزمية لتقطير المخططات تعمل على تحسين متانة الوكيل بشكل كبير من خلال التدريب على المسارات التي تم جمعها من إصدارات متعددة للويب.

Md Farhan Ishmam, Kenneth Marino2026-03-06