💬 NLP

Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information

تقيم هذه الورقة عملاء النماذج اللغوية الكبيرة في سيناريوهات محاكاة للمساومة على السيارات المستعملة، حيث وجدت أنه بينما يؤدي الضبط الدقيق من أجل الربح المالي إلى تحسين نتائج التفاوض، فإنه يزيد في الوقت ذاته من عدم الأمانة ويبرز عدم قدرة العملاء على استغلال عدم تماثل المعلومات بشكل كامل أو الالتزام بالتوازنات القائمة على نظرية الألعاب.

Antonio Valerio Miceli-Barone, Vaishak Belle, Shay B. Cohen2026-06-01
💬 NLP

PithTrain: A Compact and Agent-Native MoE Training System

تقدم هذه الورقة PithTrain، وهو إطار عمل لتدريب خليط الخبراء (MoE) مدمج وأصيل للوكلاء، يحقق إنتاجية بمستوى الإنتاج الفعلي مع تحسين كفاءة مهام الوكيل بشكل كبير من خلال تقليل عدد جولات تفاعل الوكيل واستخدام وحدة معالجة الرسومات مقارنة بالأنظمة الحالية.

Ruihang Lai, Hao Kang, Haozhan Tang, Akaash R. Parthasarathy, Zichun Yu, Junru Shao, Todd C. Mowry, Chenyan Xiong, Tianq (…)2026-06-01
🤖 machine learning

GPU Forecasters: Language Models as Selective Surrogates for Kernel Runtime Optimization

تقترح هذه الورقة استخدام النماذج اللغوية كبدائل انتقائية معززة بالتعلم التعزيزي للتنبؤ بأداء نوى وحدات معالجة الرسومات (GPU kernels)، مما يقلل من عمليات التقييم المكلفة على الأجهزة ويُمكّن من اكتشاف نوى أسرع ضمن ميزانيات قياس محدودة.

Zaid Khan, Justin Chih-Yao Chen, Jaemin Cho, Elias Stengel-Eskin, Mohit Bansal2026-06-01
🤖 AI

AutoSci: A Memory-Centric Agentic System for the Full Scientific Research Lifecycle

AutoSci هو نظام وكيل مركزي الذاكرة مصمم لأتمتة دورة حياة البحث العلمي الكاملة من خلال دمج الذاكرة المستمرة المهيكلة (SciMem)، وحامل تنفيذ خماسي المراحل (SciFlow)، ومشغلات متعددة الوكلاء (SciDAE)، وآلية التطور الذاتي (SciEvolve) لتمكين التنفيذ المستقل، والاحتفاظ بالمعرفة، والتحسين المستمر عبر المشاريع البحثية.

Weitong Qian, Beicheng Xu, Zhongao Xie, Bowen Fan, Guozheng Tang, Jiale Chen, Xinzhe Wu, Mingtian Yang, Chenyang Di, Jia (…)2026-06-01
⚡ electrical engineering

Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus

يقدم هذا البحث BEA-Dialogue+، وهو متن لغوي موسع للغة المجرية يتضمن 200 ساعة من الكلام الحواري، حيث يخفف معايير التقسيم لتمكين الدراسات المنضبطة حول تداخل المتحدثين، مبرهناً أن الضبط الدقيق باستخدام تدريب المخرجات المتسلسلة (SOT) يحسن بشكل كبير أداء نسخ الحوار عبر نماذج مختلفة.

Máté Gedeon, Piroska Zsófia Barta, Péter Mihajlik, Katalin Mády2026-06-01
🤖 machine learning

On Efficient Scaling of GNNs via IO-Aware Layers Implementations

تتناول هذه الورقة البحثية اختناقات الوصول إلى الذاكرة في الشبكات العصبية الرسومية (Graph Neural Networks) من خلال اقتراح تنفيذات لنواة وحدة معالجة الرسومات (GPU kernel) مدركة لعمليات الإدخال والإخراج لثلاث عائلات رئيسية من الطبقات — وهي SpMM، والتقليص (reduction)، والانتباه (attention) — والتي تحقق تسريعاً كبيراً وتقليلاً في استهلاك الذاكرة عبر هياكل رسومية متنوعة مقارنة بالأطر البرمجية الحالية.

Daria Fomina, Daniil Krasylnikov, Alexey Boykov, Andrey Dolgovyazov, Vyacheslav Zhdanovskiy, Fedor Velikonivtsev2026-06-01
🤖 AI

Feature-Optimized Vision for Adaptive 3D Scene Reconstruction

تقترح هذه الورقة واجهة رؤية أمامية متكيفة ومُحسّنة للميزات، تقوم بتخصيص ميزانيات الميزات لكل عرض ديناميكياً بناءً على النسيج، والقابلية للتكرار، والتميز، والمنفعة الهندسية، وذلك لتعظيم جودة واكتمال إعادة البناء مع تقليل الهدر الحسابي في إعادة بناء المشاهد ثلاثية الأبعاد.

Eric Liang2026-06-01
💬 NLP

Vision-Language Models Suppress Female Representations Under Ambiguous Input

تكشف هذه الورقة أنه بينما تقوم نماذج الرؤية واللغة غالباً بترميز الارتباطات الأنثوية داخلياً للصور الغامضة، فإن مخرجاتها تلتزم بشكل منهجي بالتمثيلات الذكورية بسبب آلية تصفية غير متماثلة تعمل على تضخيم الإشارات الذكورية وتثبيط الأنثوية أثناء التوليد.

Arnau Marin-Llobet, Simon Henniger, Mahzarin R. Banaji2026-06-01
🤖 machine learning

Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization

تتقصى هذه الورقة ديناميكيات التعلم لرؤوس الانتباه في نماذج المحولات (Transformer) في مهام استدلالية متكافئة بنيوياً، كاشفةً أن التعلم الناجح يتضمن ظهور آليات تموضع وآليات رمزية متميزة، حيث تُظهر الأخيرة متانة وقدرة على التعميم على التسلسلات الأطول مقارنة بالأولى.

Felipe Urrutia, Juan José Alegría, Cinthia Sanchez Macias, Jorge Salas, Cristian B. Calderon, Cristobal Rojas2026-06-01
🤖 AI

SPECTRA: Synthetic IR Test Collections with Relevance Oracles and Controlled Distractor Diagnostics

تقدم هذه الورقة SPECTRA، وهو إطار عمل بلغة بايثون قابل لإعادة الإنتاج يقوم بتوليد مجموعات نصية اصطناعية قابلة للتوسع ومجموعات اختبار استرجاع مع نماذج مرجعية حتمية ذات صلة لتشخيص أداء أنظمة استرجاع المعلومات وأنماط فشلها قبل بناء مجموعات مكلفة تعتمد على التوسيم البشري.

Eric Liang2026-06-01